{"as_of":"2026-08-09T16:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2d4593ba5c776d285d0ac378416a1ec7962e79c8d6541d0680d1915f22a8b653","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":20,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:28:16.864213Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":4,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2312.10003","last_updated":"2023-12-15T18:20:15Z","snapshot_observed_at":"2026-08-04T01:20:21.010579Z","submitted_at":"2023-12-15T18:20:15Z","title":"ReST meets ReAct: Self-Improvement for Multi-Step Reasoning LLM Agent","version":1},"cited_work":{"arxiv_id":"2312.10003","doi":"10.48550/arxiv.2312.10003","metadata_source":"arxiv_reference","pith_arxiv_id":"2312.10003","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2312.10003 , year=","venue":"arXiv (Cornell University)","work_id":"5eb6fcca-fd9c-48de-b5f6-c18dbf4636f4","year":2023},"citing_paper":{"arxiv_id":"2504.19678","last_updated":"2026-03-06T19:01:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-28T11:08:22Z","title":"From LLM Reasoning to Autonomous AI Agents: A Comprehensive Review","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-15T02:57:37.873567Z"},"links":{"cited_paper":"/paper/2312.10003","citing_paper":"/paper/2504.19678"},"observation_digest":"sha256:0cbd722544517323f86600b658b2d7bee6ff067d069ff3a3cb795c76aea86418","observation_id":"0d5d98b6-93e2-4658-8d54-4003accc3b97","resolution":{"observed_at":"2026-05-15T02:57:38.252446Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10003","last_updated":"2023-12-15T18:20:15Z","snapshot_observed_at":"2026-08-04T01:20:21.010579Z","submitted_at":"2023-12-15T18:20:15Z","title":"ReST meets ReAct: Self-Improvement for Multi-Step Reasoning LLM Agent","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10003","snapshot_observed_at":"2026-08-07T10:28:16.864213Z","title":"Rest meets react: Self-improvement for multi-step reasoning llm agent","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-08T02:17:06.461305Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:16.864213Z"},"links":{"cited_paper":"/paper/2312.10003","citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:289b2f2514b2f9eecc05d84a97096ebe570ec418e9b2dfc223519443af7b6408","observation_id":"e146ce08-8442-47ea-baba-77c1d7e78c41","resolution":{"observed_at":"2026-08-07T10:28:16.864213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10003","last_updated":"2023-12-15T18:20:15Z","snapshot_observed_at":"2026-08-04T01:20:21.010579Z","submitted_at":"2023-12-15T18:20:15Z","title":"ReST meets ReAct: Self-Improvement for Multi-Step Reasoning LLM Agent","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10003","snapshot_observed_at":"2026-08-04T19:34:28.337466Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09193","last_updated":"2025-09-11T07:09:30Z","snapshot_observed_at":"2026-08-07T07:37:18.552922Z","submitted_at":"2025-09-11T07:09:30Z","title":"AI Reasoning for Wireless Communications and Networking: A Survey and Perspectives","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-04T19:34:28.337466Z"},"links":{"cited_paper":"/paper/2312.10003","citing_paper":"/paper/2509.09193"},"observation_digest":"sha256:ddb3e82e35ed7cf06cf5cf63afbbb7b15690b964e70d7e522060108f3a6b4624","observation_id":"7bf92f9b-25fa-45a2-949f-e52db5e4775e","resolution":{"observed_at":"2026-08-04T19:34:28.337466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10003","last_updated":"2023-12-15T18:20:15Z","snapshot_observed_at":"2026-08-04T01:20:21.010579Z","submitted_at":"2023-12-15T18:20:15Z","title":"ReST meets ReAct: Self-Improvement for Multi-Step Reasoning LLM Agent","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10003","snapshot_observed_at":"2026-08-04T14:53:14.599607Z","title":"Rest meets react: Self-improvement for multi-step reasoning llm agent","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.22504","last_updated":"2026-05-28T15:39:50Z","snapshot_observed_at":"2026-08-06T22:26:20.796622Z","submitted_at":"2025-09-26T15:46:14Z","title":"Estimating the Empowerment of Language Model Agents","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-04T14:53:14.599607Z"},"links":{"cited_paper":"/paper/2312.10003","citing_paper":"/paper/2509.22504"},"observation_digest":"sha256:6d073ff8e40adfceb5f91dd87679a0d2f0f60967525fbfef7f19173d5f7ed72d","observation_id":"af7de01d-ebad-4268-b54c-87434c6f3bcd","resolution":{"observed_at":"2026-08-04T14:53:14.599607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10003","last_updated":"2023-12-15T18:20:15Z","snapshot_observed_at":"2026-08-04T01:20:21.010579Z","submitted_at":"2023-12-15T18:20:15Z","title":"ReST meets ReAct: Self-Improvement for Multi-Step Reasoning LLM Agent","version":1},"cited_work":{"arxiv_id":"2312.10003","doi":"10.48550/arxiv.2312.10003","metadata_source":"arxiv_reference","pith_arxiv_id":"2312.10003","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2312.10003 , year=","venue":"arXiv (Cornell University)","work_id":"5eb6fcca-fd9c-48de-b5f6-c18dbf4636f4","year":2023},"citing_paper":{"arxiv_id":"2511.20857","last_updated":"2026-05-18T16:18:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-25T21:08:07Z","title":"Evo-Memory: Benchmarking LLM Agent Test-time Learning with Self-Evolving Memory","version":1},"reference_index":234,"source":"arxiv_source","source_observed_at":"2026-05-14T23:13:15.016486Z"},"links":{"cited_paper":"/paper/2312.10003","citing_paper":"/paper/2511.20857"},"observation_digest":"sha256:0e57d020c0925d972b13d6ea3e058b244ac6fa7e0651564287ee7e9700de735b","observation_id":"70ba945b-1d86-4212-81f1-419d5feffc55","resolution":{"observed_at":"2026-05-14T23:13:15.679804Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10003","last_updated":"2023-12-15T18:20:15Z","snapshot_observed_at":"2026-08-04T01:20:21.010579Z","submitted_at":"2023-12-15T18:20:15Z","title":"ReST meets ReAct: Self-Improvement for Multi-Step Reasoning LLM Agent","version":1},"cited_work":{"arxiv_id":"2312.10003","doi":"10.48550/arxiv.2312.10003","metadata_source":"arxiv_reference","pith_arxiv_id":"2312.10003","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2312.10003 , year=","venue":"arXiv (Cornell University)","work_id":"5eb6fcca-fd9c-48de-b5f6-c18dbf4636f4","year":2023},"citing_paper":{"arxiv_id":"2601.12538","last_updated":"2026-01-18T18:58:23Z","snapshot_observed_at":"2026-08-04T22:42:23.171653Z","submitted_at":"2026-01-18T18:58:23Z","title":"Agentic Reasoning for Large Language Models","version":1},"reference_index":103,"source":"pdf_text","source_observed_at":"2026-05-17T15:14:25.558878Z"},"links":{"cited_paper":"/paper/2312.10003","citing_paper":"/paper/2601.12538"},"observation_digest":"sha256:80d88a5aacf74976b6690a9c3210f58f7afd4dba15e2915c104366c14e8e4348","observation_id":"cb05160e-8cee-452a-8503-e66f5b5c1c96","resolution":{"observed_at":"2026-05-17T15:14:25.988543Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10003","last_updated":"2023-12-15T18:20:15Z","snapshot_observed_at":"2026-08-04T01:20:21.010579Z","submitted_at":"2023-12-15T18:20:15Z","title":"ReST meets ReAct: Self-Improvement for Multi-Step Reasoning LLM Agent","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10003","snapshot_observed_at":"2026-08-03T09:21:32.684964Z","title":"Rest meets react: Self-improvement for multi-step reasoning llm agent, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.14192","last_updated":"2026-07-03T11:26:58Z","snapshot_observed_at":"2026-08-07T15:05:40.772054Z","submitted_at":"2026-01-20T17:51:56Z","title":"Toward Efficient Agents: Memory, Tool learning, and Planning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T09:21:32.684964Z"},"links":{"cited_paper":"/paper/2312.10003","citing_paper":"/paper/2601.14192"},"observation_digest":"sha256:d66758dc34ca9a1d3119209442017cf29947442244f06e8285fec27e9a74b469","observation_id":"c3be1648-17fc-4441-ab3d-2bf62885c8f5","resolution":{"observed_at":"2026-08-03T09:21:32.684964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10003","last_updated":"2023-12-15T18:20:15Z","snapshot_observed_at":"2026-08-04T01:20:21.010579Z","submitted_at":"2023-12-15T18:20:15Z","title":"ReST meets ReAct: Self-Improvement for Multi-Step Reasoning LLM Agent","version":1},"cited_work":{"arxiv_id":"2312.10003","doi":"10.48550/arxiv.2312.10003","metadata_source":"arxiv_reference","pith_arxiv_id":"2312.10003","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2312.10003 , year=","venue":"arXiv (Cornell University)","work_id":"5eb6fcca-fd9c-48de-b5f6-c18dbf4636f4","year":2023},"citing_paper":{"arxiv_id":"2604.03976","last_updated":"2026-05-04T20:58:24Z","snapshot_observed_at":"2026-07-06T22:53:01.835843Z","submitted_at":"2026-04-05T05:42:20Z","title":"Quantifying Trust: Financial Risk Management for Trustworthy AI Agents","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-13T17:16:17.464937Z"},"links":{"cited_paper":"/paper/2312.10003","citing_paper":"/paper/2604.03976"},"observation_digest":"sha256:9c2981d6a4477a09d973f60144d4013f5addff7db9739ca7b53f7ed5f6a3c23a","observation_id":"037ae162-fc22-492f-bde3-b91cfe59372d","resolution":{"observed_at":"2026-05-13T17:18:01.300645Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10003","last_updated":"2023-12-15T18:20:15Z","snapshot_observed_at":"2026-08-04T01:20:21.010579Z","submitted_at":"2023-12-15T18:20:15Z","title":"ReST meets ReAct: Self-Improvement for Multi-Step Reasoning LLM Agent","version":1},"cited_work":{"arxiv_id":"2312.10003","doi":"10.48550/arxiv.2312.10003","metadata_source":"arxiv_reference","pith_arxiv_id":"2312.10003","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2312.10003 , year=","venue":"arXiv (Cornell University)","work_id":"5eb6fcca-fd9c-48de-b5f6-c18dbf4636f4","year":2023},"citing_paper":{"arxiv_id":"2605.17900","last_updated":"2026-05-18T06:06:01Z","snapshot_observed_at":"2026-08-02T23:40:34.130341Z","submitted_at":"2026-05-18T06:06:01Z","title":"DuIVRS-2: An LLM-based Interactive Voice Response System for Large-scale POI Attribute Acquisition","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-20T10:30:48.957568Z"},"links":{"cited_paper":"/paper/2312.10003","citing_paper":"/paper/2605.17900"},"observation_digest":"sha256:06bfcbf70a46c659be48c74fb9d8a3aafbe6204f146316512681fea8149fdab9","observation_id":"7258b9e7-2cdf-4f52-9335-e577337d4d82","resolution":{"observed_at":"2026-05-20T10:33:12.922872Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10003","last_updated":"2023-12-15T18:20:15Z","snapshot_observed_at":"2026-08-04T01:20:21.010579Z","submitted_at":"2023-12-15T18:20:15Z","title":"ReST meets ReAct: Self-Improvement for Multi-Step Reasoning LLM Agent","version":1},"cited_work":{"arxiv_id":"2312.10003","doi":"10.48550/arxiv.2312.10003","metadata_source":"arxiv_reference","pith_arxiv_id":"2312.10003","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2312.10003 , year=","venue":"arXiv (Cornell University)","work_id":"5eb6fcca-fd9c-48de-b5f6-c18dbf4636f4","year":2023},"citing_paper":{"arxiv_id":"2605.30961","last_updated":"2026-05-29T07:56:31Z","snapshot_observed_at":"2026-07-06T23:40:12.939143Z","submitted_at":"2026-05-29T07:56:31Z","title":"EvoGens: A Population-Based Heuristic Search Framework for Scientific Idea Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-28T22:29:44.078911Z"},"links":{"cited_paper":"/paper/2312.10003","citing_paper":"/paper/2605.30961"},"observation_digest":"sha256:b4e8e995d74d6d99a80349e82a24282274d54f5c5dba657cec980a0273f28994","observation_id":"3352d076-4318-4d6b-b64a-b506e727b548","resolution":{"observed_at":"2026-06-28T22:32:44.146779Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10003","last_updated":"2023-12-15T18:20:15Z","snapshot_observed_at":"2026-08-04T01:20:21.010579Z","submitted_at":"2023-12-15T18:20:15Z","title":"ReST meets ReAct: Self-Improvement for Multi-Step Reasoning LLM Agent","version":1},"cited_work":{"arxiv_id":"2312.10003","doi":"10.48550/arxiv.2312.10003","metadata_source":"arxiv_reference","pith_arxiv_id":"2312.10003","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2312.10003 , year=","venue":"arXiv (Cornell University)","work_id":"5eb6fcca-fd9c-48de-b5f6-c18dbf4636f4","year":2023},"citing_paper":{"arxiv_id":"2606.07074","last_updated":"2026-06-05T09:10:50Z","snapshot_observed_at":"2026-07-06T23:46:46.925980Z","submitted_at":"2026-06-05T09:10:50Z","title":"SlimSearcher: Training Efficiency-Aware Web Agents via Adaptive Reward Gating","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-06-27T22:54:44.329613Z"},"links":{"cited_paper":"/paper/2312.10003","citing_paper":"/paper/2606.07074"},"observation_digest":"sha256:05d4667a2697e248be223c06d4f8f261fca56b7a25c6009ce81c7cc3fbfd01e0","observation_id":"4c09d938-fcb1-48b2-865a-423e2a18bd28","resolution":{"observed_at":"2026-07-02T16:17:08.710917Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10003","last_updated":"2023-12-15T18:20:15Z","snapshot_observed_at":"2026-08-04T01:20:21.010579Z","submitted_at":"2023-12-15T18:20:15Z","title":"ReST meets ReAct: Self-Improvement for Multi-Step Reasoning LLM Agent","version":1},"cited_work":{"arxiv_id":"2312.10003","doi":"10.48550/arxiv.2312.10003","metadata_source":"arxiv_reference","pith_arxiv_id":"2312.10003","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2312.10003 , year=","venue":"arXiv (Cornell University)","work_id":"5eb6fcca-fd9c-48de-b5f6-c18dbf4636f4","year":2023},"citing_paper":{"arxiv_id":"2606.09105","last_updated":"2026-06-10T01:31:19Z","snapshot_observed_at":"2026-08-08T23:31:29.031125Z","submitted_at":"2026-06-08T06:58:21Z","title":"Graph2Idea:Retrieval-Augmented Scientific Idea Generation with Graph-Structured Contexts","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-27T16:39:36.945808Z"},"links":{"cited_paper":"/paper/2312.10003","citing_paper":"/paper/2606.09105"},"observation_digest":"sha256:897140602b50f7c42f542516f27461913b55d420fcfcbad807924c7e0086ff25","observation_id":"d379452a-44fc-4c5a-bf92-c4ce6d53b990","resolution":{"observed_at":"2026-07-03T01:17:31.037482Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10003","last_updated":"2023-12-15T18:20:15Z","snapshot_observed_at":"2026-08-04T01:20:21.010579Z","submitted_at":"2023-12-15T18:20:15Z","title":"ReST meets ReAct: Self-Improvement for Multi-Step Reasoning LLM Agent","version":1},"cited_work":{"arxiv_id":"2312.10003","doi":"10.48550/arxiv.2312.10003","metadata_source":"arxiv_reference","pith_arxiv_id":"2312.10003","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2312.10003 , year=","venue":"arXiv (Cornell University)","work_id":"5eb6fcca-fd9c-48de-b5f6-c18dbf4636f4","year":2023},"citing_paper":{"arxiv_id":"2606.21090","last_updated":"2026-06-17T18:03:06Z","snapshot_observed_at":"2026-07-30T06:23:05.041940Z","submitted_at":"2026-06-17T18:03:06Z","title":"Self-Improvement Can Self-Regress: The Rise-and-Collapse Failure Mode of LLM Self-Training","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-26T21:07:28.660119Z"},"links":{"cited_paper":"/paper/2312.10003","citing_paper":"/paper/2606.21090"},"observation_digest":"sha256:796ef2b295f01616fb813201c8517f15f3dcaf03461c979c9516e71d9d8c7981","observation_id":"079675ac-308f-40a4-a1e8-8918767a667b","resolution":{"observed_at":"2026-07-04T00:29:16.726094Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10003","last_updated":"2023-12-15T18:20:15Z","snapshot_observed_at":"2026-08-04T01:20:21.010579Z","submitted_at":"2023-12-15T18:20:15Z","title":"ReST meets ReAct: Self-Improvement for Multi-Step Reasoning LLM Agent","version":1},"cited_work":{"arxiv_id":"2312.10003","doi":"10.48550/arxiv.2312.10003","metadata_source":"arxiv_reference","pith_arxiv_id":"2312.10003","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2312.10003 , year=","venue":"arXiv (Cornell University)","work_id":"5eb6fcca-fd9c-48de-b5f6-c18dbf4636f4","year":2023},"citing_paper":{"arxiv_id":"2607.00038","last_updated":"2026-06-28T18:30:46Z","snapshot_observed_at":"2026-08-01T16:40:43.486088Z","submitted_at":"2026-06-28T18:30:46Z","title":"Stop Hand-Holding Your Coding Agent: Engineering the Loops that Replace Step-by-Step Prompting","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-02T20:40:11.059493Z"},"links":{"cited_paper":"/paper/2312.10003","citing_paper":"/paper/2607.00038"},"observation_digest":"sha256:27c7b28c53a9d9b9ecbf84c61b7dfa93483ec7500ba6d648c8cf59f501af31d8","observation_id":"b5f02c49-29fc-4e89-8f0d-210781c0d1e7","resolution":{"observed_at":"2026-07-02T20:47:22.277629Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10003","last_updated":"2023-12-15T18:20:15Z","snapshot_observed_at":"2026-08-04T01:20:21.010579Z","submitted_at":"2023-12-15T18:20:15Z","title":"ReST meets ReAct: Self-Improvement for Multi-Step Reasoning LLM Agent","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10003","snapshot_observed_at":"2026-07-11T17:08:27.234032Z","title":"Rest meets react: Self-improvement for multi-step reasoning llm agent,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04569","last_updated":"2026-07-28T00:44:13Z","snapshot_observed_at":"2026-08-06T17:47:45.331955Z","submitted_at":"2026-07-06T00:42:05Z","title":"LLMs for Agentic Home Energy Management","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-11T17:08:27.234032Z"},"links":{"cited_paper":"/paper/2312.10003","citing_paper":"/paper/2607.04569"},"observation_digest":"sha256:1e6b92c344140eaf5271f92b5fbf672b2d26e265260c6f499710e0469504f6b7","observation_id":"8ceacf65-bebc-4793-b2c4-7fc4ebf54b23","resolution":{"observed_at":"2026-07-11T17:08:27.234032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10003","last_updated":"2023-12-15T18:20:15Z","snapshot_observed_at":"2026-08-04T01:20:21.010579Z","submitted_at":"2023-12-15T18:20:15Z","title":"ReST meets ReAct: Self-Improvement for Multi-Step Reasoning LLM Agent","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10003","snapshot_observed_at":"2026-08-02T08:40:33.501969Z","title":"Aksitov, S","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04569","last_updated":"2026-07-28T00:44:13Z","snapshot_observed_at":"2026-08-06T17:47:45.331955Z","submitted_at":"2026-07-06T00:42:05Z","title":"LLMs for Agentic Home Energy Management","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T08:40:33.501969Z"},"links":{"cited_paper":"/paper/2312.10003","citing_paper":"/paper/2607.04569"},"observation_digest":"sha256:32fed751d329ac4da381ac666cf549dfedadbd7caa7b348bf017e6226e352fcd","observation_id":"ee669dc4-56fa-4ab4-9f3a-51b5978ba771","resolution":{"observed_at":"2026-08-02T08:40:33.501969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10003","last_updated":"2023-12-15T18:20:15Z","snapshot_observed_at":"2026-08-04T01:20:21.010579Z","submitted_at":"2023-12-15T18:20:15Z","title":"ReST meets ReAct: Self-Improvement for Multi-Step Reasoning LLM Agent","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10003","snapshot_observed_at":"2026-07-11T13:53:36.775836Z","title":"arXiv preprint arXiv:2312.10003 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04763","last_updated":"2026-07-26T14:17:18Z","snapshot_observed_at":"2026-08-02T10:24:43.977557Z","submitted_at":"2026-07-06T07:56:53Z","title":"Multi-Turn On-Policy Distillation with Prefix Replay","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-07-11T13:53:36.775836Z"},"links":{"cited_paper":"/paper/2312.10003","citing_paper":"/paper/2607.04763"},"observation_digest":"sha256:8f74a9f268fdebe08ec8713159f11efa223bacb69e835fc17d31663cf4adac53","observation_id":"7ffba785-912c-490c-9786-776a4b314105","resolution":{"observed_at":"2026-07-11T13:53:36.775836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10003","last_updated":"2023-12-15T18:20:15Z","snapshot_observed_at":"2026-08-04T01:20:21.010579Z","submitted_at":"2023-12-15T18:20:15Z","title":"ReST meets ReAct: Self-Improvement for Multi-Step Reasoning LLM Agent","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10003","snapshot_observed_at":"2026-08-02T08:40:40.326974Z","title":"arXiv preprint arXiv:2312.10003 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04763","last_updated":"2026-07-26T14:17:18Z","snapshot_observed_at":"2026-08-02T10:24:43.977557Z","submitted_at":"2026-07-06T07:56:53Z","title":"Multi-Turn On-Policy Distillation with Prefix Replay","version":3},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-02T08:40:40.326974Z"},"links":{"cited_paper":"/paper/2312.10003","citing_paper":"/paper/2607.04763"},"observation_digest":"sha256:1ba6741ded7fd1852efc1a7d4c387dd1a35b019a795ac7325100173e33da5aab","observation_id":"6f322826-12d6-45ff-ba02-ecde46fa59be","resolution":{"observed_at":"2026-08-02T08:40:40.326974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10003","last_updated":"2023-12-15T18:20:15Z","snapshot_observed_at":"2026-08-04T01:20:21.010579Z","submitted_at":"2023-12-15T18:20:15Z","title":"ReST meets ReAct: Self-Improvement for Multi-Step Reasoning LLM Agent","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10003","snapshot_observed_at":"2026-08-01T15:07:28.624570Z","title":"Rest meets react: Self-improvement for multi-step reasoning llm agent,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18548","last_updated":"2026-07-20T22:28:16Z","snapshot_observed_at":"2026-08-04T05:23:32.973903Z","submitted_at":"2026-07-20T22:28:16Z","title":"Engineering Trustworthy Agentic AI for Critical Systems","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-01T15:07:28.624570Z"},"links":{"cited_paper":"/paper/2312.10003","citing_paper":"/paper/2607.18548"},"observation_digest":"sha256:af8482ad11794133bb3bfd2b35b5777a1d3cb6cec693567e76937265050eaf8f","observation_id":"a194edc7-af73-4ddd-8eb2-ca258a572d92","resolution":{"observed_at":"2026-08-01T15:07:28.624570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10003","last_updated":"2023-12-15T18:20:15Z","snapshot_observed_at":"2026-08-04T01:20:21.010579Z","submitted_at":"2023-12-15T18:20:15Z","title":"ReST meets ReAct: Self-Improvement for Multi-Step Reasoning LLM Agent","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10003","snapshot_observed_at":"2026-08-05T17:52:44.777206Z","title":"Plan -and-Solve: LLM-Based Task Planning for RL Agents,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-09T07:27:49.982758Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:44.777206Z"},"links":{"cited_paper":"/paper/2312.10003","citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:b4b35224c3e555c63fe0d66d1e8766b065ed56f1eed662d43f9f4ae0c4175e3f","observation_id":"63ef0a9b-0eb2-4062-acbb-75db8b113e97","resolution":{"observed_at":"2026-08-05T17:52:44.777206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2312.10003/citation-record","integrity":"/paper/2312.10003/integrity","json":"/paper/2312.10003/citation-record.json","paper":"/paper/2312.10003"},"outbound":[],"paper":{"arxiv_id":"2312.10003","last_updated":"2023-12-15T18:20:15Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-04T01:20:21.010579Z","submitted_at":"2023-12-15T18:20:15Z","title":"ReST meets ReAct: Self-Improvement for Multi-Step Reasoning LLM Agent"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 20 inbound Pith citation observations for arXiv:2312.10003."}