{"as_of":"2026-08-09T08:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9bf5ffa95bc77756182483800766d3c11e16790cf7c46b41d1d522950663d263","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":12,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:51:42.816272Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T13:59:51.871553Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.11176","last_updated":"2024-09-24T10:01:31Z","snapshot_observed_at":"2026-08-01T17:35:58.677762Z","submitted_at":"2024-06-17T03:29:13Z","title":"Watch Every Step! LLM Agent Learning via Iterative Step-Level Process Refinement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11176","snapshot_observed_at":"2026-08-07T13:51:42.816272Z","title":"Watch every step! llm agent learning via iterative step-level process refinement","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20737","last_updated":"2025-05-27T05:27:54Z","snapshot_observed_at":"2026-08-08T22:25:30.614563Z","submitted_at":"2025-05-27T05:27:54Z","title":"RRO: LLM Agent Optimization Through Rising Reward Trajectories","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:42.816272Z"},"links":{"cited_paper":"/paper/2406.11176","citing_paper":"/paper/2505.20737"},"observation_digest":"sha256:c51fc1e49ece5851812a4cd971212fd2a4039f276a2b81baaa53637bd8ad4ecf","observation_id":"9eb5afc0-64c0-48da-b24b-8ccaca91f770","resolution":{"observed_at":"2026-08-07T13:51:42.816272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11176","last_updated":"2024-09-24T10:01:31Z","snapshot_observed_at":"2026-08-01T17:35:58.677762Z","submitted_at":"2024-06-17T03:29:13Z","title":"Watch Every Step! LLM Agent Learning via Iterative Step-Level Process Refinement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11176","snapshot_observed_at":"2026-08-07T12:09:00.382912Z","title":"Watch every step! llm agent learning via iterative step-level process refinement.arXiv preprint arXiv:2406.11176, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00539","last_updated":"2025-06-04T13:39:54Z","snapshot_observed_at":"2026-08-08T09:04:37.435563Z","submitted_at":"2025-05-31T12:54:49Z","title":"ARIA: Training Language Agents with Intention-Driven Reward Aggregation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:00.382912Z"},"links":{"cited_paper":"/paper/2406.11176","citing_paper":"/paper/2506.00539"},"observation_digest":"sha256:60aa9089ba18db268ce77e7995b9755a9faba9dfb8ce4b11c1439f49ae837c13","observation_id":"b0282fc0-9feb-4ac3-a30a-0f6c441ec3e6","resolution":{"observed_at":"2026-08-07T12:09:00.382912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11176","last_updated":"2024-09-24T10:01:31Z","snapshot_observed_at":"2026-08-01T17:35:58.677762Z","submitted_at":"2024-06-17T03:29:13Z","title":"Watch Every Step! LLM Agent Learning via Iterative Step-Level Process Refinement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11176","snapshot_observed_at":"2026-08-06T16:23:32.671182Z","title":"Watch every step! llm agent learning via iterative step-level process refinement","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.13712","last_updated":"2025-07-18T07:52:19Z","snapshot_observed_at":"2026-08-06T16:15:28.755545Z","submitted_at":"2025-07-18T07:52:19Z","title":"LLaPipe: LLM-Guided Reinforcement Learning for Automated Data Preparation Pipeline Construction","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T16:23:32.671182Z"},"links":{"cited_paper":"/paper/2406.11176","citing_paper":"/paper/2507.13712"},"observation_digest":"sha256:f72799fb165d36d9ccc81b19101578c4aaed4436f016ed9cf4a69de836ce89d6","observation_id":"b1f80aea-97f8-48a6-95d1-188bcd44a41f","resolution":{"observed_at":"2026-08-06T16:23:32.671182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11176","last_updated":"2024-09-24T10:01:31Z","snapshot_observed_at":"2026-08-01T17:35:58.677762Z","submitted_at":"2024-06-17T03:29:13Z","title":"Watch Every Step! LLM Agent Learning via Iterative Step-Level Process Refinement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11176","snapshot_observed_at":"2026-08-05T20:35:47.501357Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10257","last_updated":"2025-08-14T00:51:36Z","snapshot_observed_at":"2026-08-07T13:33:54.413844Z","submitted_at":"2025-08-14T00:51:36Z","title":"Source Component Shift Adaptation via Offline Decomposition and Online Mixing Approach","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-05T20:35:47.501357Z"},"links":{"cited_paper":"/paper/2406.11176","citing_paper":"/paper/2508.10257"},"observation_digest":"sha256:81e543b0b2ec981b61519234b0c3ae75db4830302fee0d8eda5698d7b675bf4d","observation_id":"d41d0aa5-2fdd-42f2-b98b-92a9fc215029","resolution":{"observed_at":"2026-08-05T20:35:47.501357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11176","last_updated":"2024-09-24T10:01:31Z","snapshot_observed_at":"2026-08-01T17:35:58.677762Z","submitted_at":"2024-06-17T03:29:13Z","title":"Watch Every Step! LLM Agent Learning via Iterative Step-Level Process Refinement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11176","snapshot_observed_at":"2026-08-05T20:38:44.914638Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10259","last_updated":"2025-08-14T00:57:58Z","snapshot_observed_at":"2026-08-08T01:00:17.824912Z","submitted_at":"2025-08-14T00:57:58Z","title":"Leveraging OS-Level Primitives for Robotic Action Management","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-05T20:38:44.914638Z"},"links":{"cited_paper":"/paper/2406.11176","citing_paper":"/paper/2508.10259"},"observation_digest":"sha256:c68a3ecbcf9106dad45701d3b5ff0798f9db00073d8cfb392c0f22e43e58acde","observation_id":"b8a50294-3d51-4ab8-b6ae-ac7158af8ec7","resolution":{"observed_at":"2026-08-05T20:38:44.914638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11176","last_updated":"2024-09-24T10:01:31Z","snapshot_observed_at":"2026-08-01T17:35:58.677762Z","submitted_at":"2024-06-17T03:29:13Z","title":"Watch Every Step! LLM Agent Learning via Iterative Step-Level Process Refinement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11176","snapshot_observed_at":"2026-08-04T08:55:58.792516Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.18383","last_updated":"2026-06-18T07:59:59Z","snapshot_observed_at":"2026-08-08T04:40:12.618095Z","submitted_at":"2025-10-21T08:03:14Z","title":"MENTOR: Reinforcement Learning via Flexible Teacher-Optimized Rewards for Tool-Use Distillation","version":3},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-04T08:55:58.792516Z"},"links":{"cited_paper":"/paper/2406.11176","citing_paper":"/paper/2510.18383"},"observation_digest":"sha256:a7ec6b7ac339c93d1e0b47e7e7813760dd9d27c55e07d319b2af0d92073d73bb","observation_id":"e141f2e5-c99d-43d4-acb4-8e21cc1a7426","resolution":{"observed_at":"2026-08-04T08:55:58.792516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11176","last_updated":"2024-09-24T10:01:31Z","snapshot_observed_at":"2026-08-01T17:35:58.677762Z","submitted_at":"2024-06-17T03:29:13Z","title":"Watch Every Step! LLM Agent Learning via Iterative Step-Level Process Refinement","version":2},"cited_work":{"arxiv_id":"2406.11176","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.11176","snapshot_observed_at":"2026-07-04T13:59:51.871553Z","title":"Watch every step! llm agent learning via iterative step-level process refinement","venue":null,"work_id":"a4789c21-1d58-4330-961c-e34441f18132","year":2024},"citing_paper":{"arxiv_id":"2604.23194","last_updated":"2026-04-25T07:54:23Z","snapshot_observed_at":"2026-07-06T23:09:29.537323Z","submitted_at":"2026-04-25T07:54:23Z","title":"From Coarse to Fine: Self-Adaptive Hierarchical Planning for LLM Agents","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-08T08:10:36.579810Z"},"links":{"cited_paper":"/paper/2406.11176","citing_paper":"/paper/2604.23194"},"observation_digest":"sha256:8d306a1229ae8f95d84b63f5d5a8fa249586bc2b0bbd98368239527968237fbf","observation_id":"d03d49af-80a8-499d-b8ca-7a88a1d5fd69","resolution":{"observed_at":"2026-05-11T20:46:10.629997Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11176","last_updated":"2024-09-24T10:01:31Z","snapshot_observed_at":"2026-08-01T17:35:58.677762Z","submitted_at":"2024-06-17T03:29:13Z","title":"Watch Every Step! LLM Agent Learning via Iterative Step-Level Process Refinement","version":2},"cited_work":{"arxiv_id":"2406.11176","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.11176","snapshot_observed_at":"2026-07-04T13:59:51.871553Z","title":"Watch every step! llm agent learning via iterative step-level process refinement","venue":null,"work_id":"a4789c21-1d58-4330-961c-e34441f18132","year":2024},"citing_paper":{"arxiv_id":"2605.20061","last_updated":"2026-05-19T16:19:29Z","snapshot_observed_at":"2026-08-07T09:15:12.932880Z","submitted_at":"2026-05-19T16:19:29Z","title":"Rewarding Beliefs, Not Actions: Consistency-Guided Credit Assignment for Long-Horizon Agents","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-20T05:35:45.084011Z"},"links":{"cited_paper":"/paper/2406.11176","citing_paper":"/paper/2605.20061"},"observation_digest":"sha256:cee383c0c8d13d2425dea285e907b4524ec1c6ecc14038a4d8f586cb857779f6","observation_id":"17c7d3ff-d50a-45d5-868b-bfe81a49f6fa","resolution":{"observed_at":"2026-05-20T05:38:05.519281Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11176","last_updated":"2024-09-24T10:01:31Z","snapshot_observed_at":"2026-08-01T17:35:58.677762Z","submitted_at":"2024-06-17T03:29:13Z","title":"Watch Every Step! LLM Agent Learning via Iterative Step-Level Process Refinement","version":2},"cited_work":{"arxiv_id":"2406.11176","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.11176","snapshot_observed_at":"2026-07-04T13:59:51.871553Z","title":"Watch every step! llm agent learning via iterative step-level process refinement","venue":null,"work_id":"a4789c21-1d58-4330-961c-e34441f18132","year":2024},"citing_paper":{"arxiv_id":"2606.22385","last_updated":"2026-06-21T08:22:23Z","snapshot_observed_at":"2026-08-01T18:23:09.613202Z","submitted_at":"2026-06-21T08:22:23Z","title":"MetaPS: Adaptive Programmatic Strategy Selection for Market Agents","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-06-26T11:06:28.690956Z"},"links":{"cited_paper":"/paper/2406.11176","citing_paper":"/paper/2606.22385"},"observation_digest":"sha256:f9b04b9244830b25b160d7c132e929f2df7b78a8a0ecf586f50d72fcda11d54c","observation_id":"e7d12215-7382-44ad-8576-043a4b10013d","resolution":{"observed_at":"2026-07-04T08:39:42.661633Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11176","last_updated":"2024-09-24T10:01:31Z","snapshot_observed_at":"2026-08-01T17:35:58.677762Z","submitted_at":"2024-06-17T03:29:13Z","title":"Watch Every Step! LLM Agent Learning via Iterative Step-Level Process Refinement","version":2},"cited_work":{"arxiv_id":"2406.11176","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.11176","snapshot_observed_at":"2026-07-04T13:59:51.871553Z","title":"Watch every step! llm agent learning via iterative step-level process refinement","venue":null,"work_id":"a4789c21-1d58-4330-961c-e34441f18132","year":2024},"citing_paper":{"arxiv_id":"2606.27369","last_updated":"2026-06-25T17:59:36Z","snapshot_observed_at":"2026-08-03T05:17:54.539513Z","submitted_at":"2026-06-25T17:59:36Z","title":"Reinforcement Learning without Ground-Truth Solutions can Improve LLMs","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-06-26T04:47:47.691913Z"},"links":{"cited_paper":"/paper/2406.11176","citing_paper":"/paper/2606.27369"},"observation_digest":"sha256:6baee49d8dc8300727d5f81250b94171c52ce01c30745c7593905fb3cd3c82d0","observation_id":"25f690f8-8941-470c-999a-6c17f4848234","resolution":{"observed_at":"2026-07-04T13:59:51.873179Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11176","last_updated":"2024-09-24T10:01:31Z","snapshot_observed_at":"2026-08-01T17:35:58.677762Z","submitted_at":"2024-06-17T03:29:13Z","title":"Watch Every Step! LLM Agent Learning via Iterative Step-Level Process Refinement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11176","snapshot_observed_at":"2026-08-01T13:54:21.160424Z","title":"arXiv preprint arXiv:2406.11176 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18979","last_updated":"2026-07-21T11:14:33Z","snapshot_observed_at":"2026-08-06T13:13:54.204332Z","submitted_at":"2026-07-21T11:14:33Z","title":"Fishing Out Free Riders: Shapley-Based Reward Attribution for Parallel Reasoning via Reinforcement Learning","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-01T13:54:21.160424Z"},"links":{"cited_paper":"/paper/2406.11176","citing_paper":"/paper/2607.18979"},"observation_digest":"sha256:76d0382feddcc2dc173cf523185b4a41b5ed62f95a99d3f4c2cdc67a1336ed93","observation_id":"b00c4d8e-0e9d-4b43-a145-7500acd36a99","resolution":{"observed_at":"2026-08-01T13:54:21.160424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11176","last_updated":"2024-09-24T10:01:31Z","snapshot_observed_at":"2026-08-01T17:35:58.677762Z","submitted_at":"2024-06-17T03:29:13Z","title":"Watch Every Step! LLM Agent Learning via Iterative Step-Level Process Refinement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11176","snapshot_observed_at":"2026-07-31T00:46:12.901360Z","title":"Watch every step! llm agent learning via iterative step-level process refinement.arXiv preprint arXiv:2406.11176, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27443","last_updated":"2026-07-29T20:14:43Z","snapshot_observed_at":"2026-08-06T07:25:46.863771Z","submitted_at":"2026-07-29T20:14:43Z","title":"Leveraging Trajectory Graphs for Pre-Execution Error Diagnosis in Agentic LLM Systems","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-07-31T00:46:12.901360Z"},"links":{"cited_paper":"/paper/2406.11176","citing_paper":"/paper/2607.27443"},"observation_digest":"sha256:5ba55e03e52f909300344760cb4448a50ad90ad2f41edd7b0aa78d642e5aabd9","observation_id":"4c53a9ff-d3fa-4631-bbf8-a4207098375a","resolution":{"observed_at":"2026-07-31T00:46:12.901360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2406.11176/citation-record","integrity":"/paper/2406.11176/integrity","json":"/paper/2406.11176/citation-record.json","paper":"/paper/2406.11176"},"outbound":[],"paper":{"arxiv_id":"2406.11176","last_updated":"2024-09-24T10:01:31Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-01T17:35:58.677762Z","submitted_at":"2024-06-17T03:29:13Z","title":"Watch Every Step! LLM Agent Learning via Iterative Step-Level Process Refinement"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 12 inbound Pith citation observations for arXiv:2406.11176."}