{"as_of":"2026-08-10T04:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9fc3cd7b6a050e473a5723b5923771cc4c4e76b4739a2d34ec9d18a8be1149a2","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T20:55:39.676641Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-08T15:33:01.138366Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-08T15:35:07.133077Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.19047","last_updated":"2026-06-17T13:13:32Z","snapshot_observed_at":"2026-07-06T23:54:23.090538Z","submitted_at":"2026-06-17T13:13:32Z","title":"RODS: Reward-Driven Online Data Synthesis for Multi-Turn Tool-Use Agents","version":1},"cited_work":{"arxiv_id":"2606.19047","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.19047","snapshot_observed_at":"2026-07-08T15:35:07.133077Z","title":"RODS: Reward-Driven Online Data Synthesis for Multi-Turn Tool-Use Agents","venue":"cs.AI","work_id":"4563d762-80e3-4ede-bb63-50a77e09132e","year":2026},"citing_paper":{"arxiv_id":"2607.06140","last_updated":"2026-07-07T11:07:00Z","snapshot_observed_at":"2026-07-10T23:17:34.345638Z","submitted_at":"2026-07-07T11:07:00Z","title":"CurateEvo: Data-Curation Evolving for Agentic Post-Training","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-08T15:33:01.138366Z"},"links":{"cited_paper":"/paper/2606.19047","citing_paper":"/paper/2607.06140"},"observation_digest":"sha256:4776d07237d0f93f0fee25206869cc16e9d4d33653c1d913468d8aa0be978944","observation_id":"dc8dbc5d-bb9b-4e7f-8547-067159f34530","resolution":{"observed_at":"2026-07-08T15:35:07.134586Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2606.19047/citation-record","integrity":"/paper/2606.19047/integrity","json":"/paper/2606.19047/citation-record.json","paper":"/paper/2606.19047"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T20:55:39.676641Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.19047","last_updated":"2026-06-17T13:13:32Z","snapshot_observed_at":"2026-07-06T23:54:23.090538Z","submitted_at":"2026-06-17T13:13:32Z","title":"RODS: Reward-Driven Online Data Synthesis for Multi-Turn Tool-Use Agents","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-26T20:55:39.676641Z"},"links":{"citing_paper":"/paper/2606.19047"},"observation_digest":"sha256:a31531efa6eae179f0c45c711491c79641bc55d01aedfbc9a4e7f97771b7e925","observation_id":"b8c0e058-d79b-4751-9af9-40086062e81f","resolution":{"observed_at":"2026-06-26T20:55:39.676641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T20:55:39.676641Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.19047","last_updated":"2026-06-17T13:13:32Z","snapshot_observed_at":"2026-07-06T23:54:23.090538Z","submitted_at":"2026-06-17T13:13:32Z","title":"RODS: Reward-Driven Online Data Synthesis for Multi-Turn Tool-Use Agents","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-26T20:55:39.676641Z"},"links":{"citing_paper":"/paper/2606.19047"},"observation_digest":"sha256:684d9914173537b8fb9056da0c978d6ee3e0cc85ad12ba8328f7bc7a6031ab62","observation_id":"b2e41a6a-4a15-4311-97ca-a74cbbfeb0fc","resolution":{"observed_at":"2026-06-26T20:55:39.676641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T20:55:39.676641Z","title":"This guarantees zero data loss across restart boundaries and lets the curriculum resume where it was interrupted","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.19047","last_updated":"2026-06-17T13:13:32Z","snapshot_observed_at":"2026-07-06T23:54:23.090538Z","submitted_at":"2026-06-17T13:13:32Z","title":"RODS: Reward-Driven Online Data Synthesis for Multi-Turn Tool-Use Agents","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-26T20:55:39.676641Z"},"links":{"citing_paper":"/paper/2606.19047"},"observation_digest":"sha256:49330d8606011862cc5e26ff18bfff21416bd6b7b308b36c2573177e9615b5a8","observation_id":"bf37d597-9671-4d93-8a9d-ef46c12b89c5","resolution":{"observed_at":"2026-06-26T20:55:39.676641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T20:55:39.676641Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.19047","last_updated":"2026-06-17T13:13:32Z","snapshot_observed_at":"2026-07-06T23:54:23.090538Z","submitted_at":"2026-06-17T13:13:32Z","title":"RODS: Reward-Driven Online Data Synthesis for Multi-Turn Tool-Use Agents","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-26T20:55:39.676641Z"},"links":{"citing_paper":"/paper/2606.19047"},"observation_digest":"sha256:6174ea11b0d5144fbbdc893758d1d1746a963287f830de4f6cddfdb8aa82c410","observation_id":"504d187b-7a67-47b2-8974-a6f3ec679cfe","resolution":{"observed_at":"2026-06-26T20:55:39.676641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T20:55:39.676641Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.19047","last_updated":"2026-06-17T13:13:32Z","snapshot_observed_at":"2026-07-06T23:54:23.090538Z","submitted_at":"2026-06-17T13:13:32Z","title":"RODS: Reward-Driven Online Data Synthesis for Multi-Turn Tool-Use Agents","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-26T20:55:39.676641Z"},"links":{"citing_paper":"/paper/2606.19047"},"observation_digest":"sha256:b3446371a5131c4b5d93e2aea8580e47e69771fbb87fe25c33c66cebfcc86f87","observation_id":"efea34bd-4fd8-4752-b3ea-62f8d8a97332","resolution":{"observed_at":"2026-06-26T20:55:39.676641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T20:55:39.676641Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.19047","last_updated":"2026-06-17T13:13:32Z","snapshot_observed_at":"2026-07-06T23:54:23.090538Z","submitted_at":"2026-06-17T13:13:32Z","title":"RODS: Reward-Driven Online Data Synthesis for Multi-Turn Tool-Use Agents","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-26T20:55:39.676641Z"},"links":{"citing_paper":"/paper/2606.19047"},"observation_digest":"sha256:c04672a84824c94e6da1c7c3900fc41e09a3ac6c2ecf0685564d5c3aab30dd64","observation_id":"ce30c291-27fe-4e34-aeb2-75e834649665","resolution":{"observed_at":"2026-06-26T20:55:39.676641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T20:55:39.676641Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.19047","last_updated":"2026-06-17T13:13:32Z","snapshot_observed_at":"2026-07-06T23:54:23.090538Z","submitted_at":"2026-06-17T13:13:32Z","title":"RODS: Reward-Driven Online Data Synthesis for Multi-Turn Tool-Use Agents","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-26T20:55:39.676641Z"},"links":{"citing_paper":"/paper/2606.19047"},"observation_digest":"sha256:71efc55fa9a00278b4753613bc438aa85773ecdcd5ee445155293e509129ea6a","observation_id":"204328c8-b4e7-4e6b-b251-d59c33331866","resolution":{"observed_at":"2026-06-26T20:55:39.676641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T20:55:39.676641Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.19047","last_updated":"2026-06-17T13:13:32Z","snapshot_observed_at":"2026-07-06T23:54:23.090538Z","submitted_at":"2026-06-17T13:13:32Z","title":"RODS: Reward-Driven Online Data Synthesis for Multi-Turn Tool-Use Agents","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-26T20:55:39.676641Z"},"links":{"citing_paper":"/paper/2606.19047"},"observation_digest":"sha256:b4b291955b3f0133318640fd1ff58a0e47afa8846cceb3bfeded5bf9f7cd1835","observation_id":"d816d676-4017-4e94-ab29-fea82f1c0ac4","resolution":{"observed_at":"2026-06-26T20:55:39.676641Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T20:55:39.676641Z","title":"Closed”→“Open","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.19047","last_updated":"2026-06-17T13:13:32Z","snapshot_observed_at":"2026-07-06T23:54:23.090538Z","submitted_at":"2026-06-17T13:13:32Z","title":"RODS: Reward-Driven Online Data Synthesis for Multi-Turn Tool-Use Agents","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-26T20:55:39.676641Z"},"links":{"citing_paper":"/paper/2606.19047"},"observation_digest":"sha256:abbf1d48862f0d404b2e5121a05564950beb040c3a3955b241fae848965df676","observation_id":"3eb179f6-e4d5-42d4-ac05-8ac702439028","resolution":{"observed_at":"2026-06-26T20:55:39.676641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T20:55:39.676641Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.19047","last_updated":"2026-06-17T13:13:32Z","snapshot_observed_at":"2026-07-06T23:54:23.090538Z","submitted_at":"2026-06-17T13:13:32Z","title":"RODS: Reward-Driven Online Data Synthesis for Multi-Turn Tool-Use Agents","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-26T20:55:39.676641Z"},"links":{"citing_paper":"/paper/2606.19047"},"observation_digest":"sha256:d01c5a3f3556b184f3efc784150aa7fac3f5e8fd55b6bff9d8449c8f9f4c90f2","observation_id":"a0fff012-cb69-4260-9727-4c3d36bf9b19","resolution":{"observed_at":"2026-06-26T20:55:39.676641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T20:55:39.676641Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.19047","last_updated":"2026-06-17T13:13:32Z","snapshot_observed_at":"2026-07-06T23:54:23.090538Z","submitted_at":"2026-06-17T13:13:32Z","title":"RODS: Reward-Driven Online Data Synthesis for Multi-Turn Tool-Use Agents","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-26T20:55:39.676641Z"},"links":{"citing_paper":"/paper/2606.19047"},"observation_digest":"sha256:b90e4e23ffed63b10c689610f661e576f28cac2f367df927e1b6a9fb5f0dbe64","observation_id":"1e5e7cf2-b0c1-45ec-9b05-ac377acb7ed6","resolution":{"observed_at":"2026-06-26T20:55:39.676641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T20:55:39.676641Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.19047","last_updated":"2026-06-17T13:13:32Z","snapshot_observed_at":"2026-07-06T23:54:23.090538Z","submitted_at":"2026-06-17T13:13:32Z","title":"RODS: Reward-Driven Online Data Synthesis for Multi-Turn Tool-Use Agents","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-26T20:55:39.676641Z"},"links":{"citing_paper":"/paper/2606.19047"},"observation_digest":"sha256:eee624590a9740a5205a698d69acf12090f0ad99af7b3112ee49ab8509a0a3f3","observation_id":"8cc7a742-3362-4b44-be73-1f401e5d4b0c","resolution":{"observed_at":"2026-06-26T20:55:39.676641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T20:55:39.676641Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.19047","last_updated":"2026-06-17T13:13:32Z","snapshot_observed_at":"2026-07-06T23:54:23.090538Z","submitted_at":"2026-06-17T13:13:32Z","title":"RODS: Reward-Driven Online Data Synthesis for Multi-Turn Tool-Use Agents","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-26T20:55:39.676641Z"},"links":{"citing_paper":"/paper/2606.19047"},"observation_digest":"sha256:fa8a047e2bc092ce57fab495633d8f08c7692e6e3631d89de29cfad9f690e385","observation_id":"9c2a239c-1ce8-4031-833a-b5f93653e4f0","resolution":{"observed_at":"2026-06-26T20:55:39.676641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T20:55:39.676641Z","title":"IMPORTANT: Output exactly{num_turns}queries, one for each turn","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.19047","last_updated":"2026-06-17T13:13:32Z","snapshot_observed_at":"2026-07-06T23:54:23.090538Z","submitted_at":"2026-06-17T13:13:32Z","title":"RODS: Reward-Driven Online Data Synthesis for Multi-Turn Tool-Use Agents","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-26T20:55:39.676641Z"},"links":{"citing_paper":"/paper/2606.19047"},"observation_digest":"sha256:d00b53171fe9836d899dfd50b9fdfd6751ec128a335bda255f87239e7081131c","observation_id":"d3dbfbcc-db0e-48b6-bb64-aa5da66c7a31","resolution":{"observed_at":"2026-06-26T20:55:39.676641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T20:55:39.676641Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.19047","last_updated":"2026-06-17T13:13:32Z","snapshot_observed_at":"2026-07-06T23:54:23.090538Z","submitted_at":"2026-06-17T13:13:32Z","title":"RODS: Reward-Driven Online Data Synthesis for Multi-Turn Tool-Use Agents","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-26T20:55:39.676641Z"},"links":{"citing_paper":"/paper/2606.19047"},"observation_digest":"sha256:c69617c9336d7e7f8f112d68ef537d08df690c3b0e2f15372bcdfb0167fff7cc","observation_id":"ca14355d-315d-4618-b245-6acf43370c00","resolution":{"observed_at":"2026-06-26T20:55:39.676641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T20:55:39.676641Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.19047","last_updated":"2026-06-17T13:13:32Z","snapshot_observed_at":"2026-07-06T23:54:23.090538Z","submitted_at":"2026-06-17T13:13:32Z","title":"RODS: Reward-Driven Online Data Synthesis for Multi-Turn Tool-Use Agents","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-26T20:55:39.676641Z"},"links":{"citing_paper":"/paper/2606.19047"},"observation_digest":"sha256:42ba97eb3769f0e7d9e9aceb4eb262542b936c810adb363d395b7827da481dcc","observation_id":"319cd29a-7bbb-43db-9779-4cb6499e67ed","resolution":{"observed_at":"2026-06-26T20:55:39.676641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T20:55:39.676641Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.19047","last_updated":"2026-06-17T13:13:32Z","snapshot_observed_at":"2026-07-06T23:54:23.090538Z","submitted_at":"2026-06-17T13:13:32Z","title":"RODS: Reward-Driven Online Data Synthesis for Multi-Turn Tool-Use Agents","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-26T20:55:39.676641Z"},"links":{"citing_paper":"/paper/2606.19047"},"observation_digest":"sha256:a4f084bf74a82a63a96ee2688fe895f07409317cca94213c4f3d20adf54ae2b6","observation_id":"c85900a2-09bf-498c-a6ec-90b3a5d20449","resolution":{"observed_at":"2026-06-26T20:55:39.676641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T20:55:39.676641Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.19047","last_updated":"2026-06-17T13:13:32Z","snapshot_observed_at":"2026-07-06T23:54:23.090538Z","submitted_at":"2026-06-17T13:13:32Z","title":"RODS: Reward-Driven Online Data Synthesis for Multi-Turn Tool-Use Agents","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-26T20:55:39.676641Z"},"links":{"citing_paper":"/paper/2606.19047"},"observation_digest":"sha256:5dbf9e12517f64f70eeae774513f55cd1bbe0a27d0556b836bf9f70a328b30ba","observation_id":"0dc032b1-6ae6-4c92-8179-0a50c19333d1","resolution":{"observed_at":"2026-06-26T20:55:39.676641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T20:55:39.676641Z","title":"Thought Process","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.19047","last_updated":"2026-06-17T13:13:32Z","snapshot_observed_at":"2026-07-06T23:54:23.090538Z","submitted_at":"2026-06-17T13:13:32Z","title":"RODS: Reward-Driven Online Data Synthesis for Multi-Turn Tool-Use Agents","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-26T20:55:39.676641Z"},"links":{"citing_paper":"/paper/2606.19047"},"observation_digest":"sha256:63e6938fdb57d77f69dfed5b0f536a43312f8cf542ad0d0f31a64f1635af52db","observation_id":"ba194d05-8e07-46de-a848-c5897cdc5c6e","resolution":{"observed_at":"2026-06-26T20:55:39.676641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T20:55:39.676641Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.19047","last_updated":"2026-06-17T13:13:32Z","snapshot_observed_at":"2026-07-06T23:54:23.090538Z","submitted_at":"2026-06-17T13:13:32Z","title":"RODS: Reward-Driven Online Data Synthesis for Multi-Turn Tool-Use Agents","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-26T20:55:39.676641Z"},"links":{"citing_paper":"/paper/2606.19047"},"observation_digest":"sha256:984217387c7bf4479addc79132510c6abf2e2e327ee85d0beb863e6e3131fe91","observation_id":"064003ea-127b-4eed-8680-06db0d97ccc7","resolution":{"observed_at":"2026-06-26T20:55:39.676641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T20:55:39.676641Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.19047","last_updated":"2026-06-17T13:13:32Z","snapshot_observed_at":"2026-07-06T23:54:23.090538Z","submitted_at":"2026-06-17T13:13:32Z","title":"RODS: Reward-Driven Online Data Synthesis for Multi-Turn Tool-Use Agents","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-26T20:55:39.676641Z"},"links":{"citing_paper":"/paper/2606.19047"},"observation_digest":"sha256:3b554ec6a5f0504deb489a43276ea5e3b9310fc9e1a5bda8f00580300ffb4fbd","observation_id":"f90cb9a5-a6f9-4e99-a65e-03dce640f738","resolution":{"observed_at":"2026-06-26T20:55:39.676641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T20:55:39.676641Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.19047","last_updated":"2026-06-17T13:13:32Z","snapshot_observed_at":"2026-07-06T23:54:23.090538Z","submitted_at":"2026-06-17T13:13:32Z","title":"RODS: Reward-Driven Online Data Synthesis for Multi-Turn Tool-Use Agents","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-26T20:55:39.676641Z"},"links":{"citing_paper":"/paper/2606.19047"},"observation_digest":"sha256:e5c510c10e13a5b88b8bc7551dd189088ae9e259ae0dbc1b0ca5d78fd3734b27","observation_id":"2cee414f-4abe-457f-af9f-bc5c3278a72b","resolution":{"observed_at":"2026-06-26T20:55:39.676641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T20:55:39.676641Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.19047","last_updated":"2026-06-17T13:13:32Z","snapshot_observed_at":"2026-07-06T23:54:23.090538Z","submitted_at":"2026-06-17T13:13:32Z","title":"RODS: Reward-Driven Online Data Synthesis for Multi-Turn Tool-Use Agents","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-26T20:55:39.676641Z"},"links":{"citing_paper":"/paper/2606.19047"},"observation_digest":"sha256:d27c7d6f3f4b78841fa6d41f64ad2fe58adad0006c1f72089e3e3d1eac3f8575","observation_id":"6cd54499-81c6-4aeb-ba1e-464ddbbe201c","resolution":{"observed_at":"2026-06-26T20:55:39.676641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T20:55:39.676641Z","title":"The pipeline processes each turn sequentially through the following stages:","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.19047","last_updated":"2026-06-17T13:13:32Z","snapshot_observed_at":"2026-07-06T23:54:23.090538Z","submitted_at":"2026-06-17T13:13:32Z","title":"RODS: Reward-Driven Online Data Synthesis for Multi-Turn Tool-Use Agents","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-26T20:55:39.676641Z"},"links":{"citing_paper":"/paper/2606.19047"},"observation_digest":"sha256:8d5f648443394653a0ca229569071ae88278f8631ef08fa19570b03e68d25ef4","observation_id":"10ffea8b-78d7-42c5-aee4-9ca1ccbae59e","resolution":{"observed_at":"2026-06-26T20:55:39.676641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T20:55:39.676641Z","title":"HIGH-LEVEL functions are automatically decomposed into sequences of BOTTOM-LEVEL API calls","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.19047","last_updated":"2026-06-17T13:13:32Z","snapshot_observed_at":"2026-07-06T23:54:23.090538Z","submitted_at":"2026-06-17T13:13:32Z","title":"RODS: Reward-Driven Online Data Synthesis for Multi-Turn Tool-Use Agents","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-26T20:55:39.676641Z"},"links":{"citing_paper":"/paper/2606.19047"},"observation_digest":"sha256:683683bdc506036999e3555ee7cd5e40de39b660266abd8bac5f0036022c3923","observation_id":"14729177-8123-4599-aa00-cc451c650aba","resolution":{"observed_at":"2026-06-26T20:55:39.676641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T20:55:39.676641Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.19047","last_updated":"2026-06-17T13:13:32Z","snapshot_observed_at":"2026-07-06T23:54:23.090538Z","submitted_at":"2026-06-17T13:13:32Z","title":"RODS: Reward-Driven Online Data Synthesis for Multi-Turn Tool-Use Agents","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-26T20:55:39.676641Z"},"links":{"citing_paper":"/paper/2606.19047"},"observation_digest":"sha256:dc20326593cb256efb2791133967be18ece2690649fa65fc635a755620fba134","observation_id":"2197174c-5c6c-4d36-affd-1e74ce2b797c","resolution":{"observed_at":"2026-06-26T20:55:39.676641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T20:55:39.676641Z","title":"The VM maintains a complete environment state (file systems, account balances, database entries, etc.) and returns execution results or error messages","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.19047","last_updated":"2026-06-17T13:13:32Z","snapshot_observed_at":"2026-07-06T23:54:23.090538Z","submitted_at":"2026-06-17T13:13:32Z","title":"RODS: Reward-Driven Online Data Synthesis for Multi-Turn Tool-Use Agents","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-26T20:55:39.676641Z"},"links":{"citing_paper":"/paper/2606.19047"},"observation_digest":"sha256:e683eab9b3af66c115fabcaae84a1b1e731316c39081d0750defa4db0428be98","observation_id":"9f1c3020-94ae-4bda-9fe6-112808621927","resolution":{"observed_at":"2026-06-26T20:55:39.676641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T20:55:39.676641Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.19047","last_updated":"2026-06-17T13:13:32Z","snapshot_observed_at":"2026-07-06T23:54:23.090538Z","submitted_at":"2026-06-17T13:13:32Z","title":"RODS: Reward-Driven Online Data Synthesis for Multi-Turn Tool-Use Agents","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-26T20:55:39.676641Z"},"links":{"citing_paper":"/paper/2606.19047"},"observation_digest":"sha256:7999c43ea36cc635394a6079533a6f7159adbfaedb532fd7011555804b77c384","observation_id":"16fb2c49-588a-4266-b483-5147a9532003","resolution":{"observed_at":"2026-06-26T20:55:39.676641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T20:55:39.676641Z","title":"Use BOTTOM-LEVEL functions only","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.19047","last_updated":"2026-06-17T13:13:32Z","snapshot_observed_at":"2026-07-06T23:54:23.090538Z","submitted_at":"2026-06-17T13:13:32Z","title":"RODS: Reward-Driven Online Data Synthesis for Multi-Turn Tool-Use Agents","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-26T20:55:39.676641Z"},"links":{"citing_paper":"/paper/2606.19047"},"observation_digest":"sha256:14d0e0725be502c6a96836b8c1e2f27c93a8d0f59b83594a624e430721329a87","observation_id":"f76e2cd9-1ed1-44f9-a8a8-e0192a1e7476","resolution":{"observed_at":"2026-06-26T20:55:39.676641Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T20:55:39.676641Z","title":"Patches are accumulated across retries via recursive deep-merge, where later patches override earlier ones for the same field but coexist for different fields","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.19047","last_updated":"2026-06-17T13:13:32Z","snapshot_observed_at":"2026-07-06T23:54:23.090538Z","submitted_at":"2026-06-17T13:13:32Z","title":"RODS: Reward-Driven Online Data Synthesis for Multi-Turn Tool-Use Agents","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-26T20:55:39.676641Z"},"links":{"citing_paper":"/paper/2606.19047"},"observation_digest":"sha256:dfe2ffec5b44fe4b2bdc3e92c84f619e5a7823947c02561fc9d7f14a3c42c4c2","observation_id":"0b019b51-d8e0-45b0-b32c-9793d234026f","resolution":{"observed_at":"2026-06-26T20:55:39.676641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T20:55:39.676641Z","title":"Use BOTTOM-LEVEL functions only","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.19047","last_updated":"2026-06-17T13:13:32Z","snapshot_observed_at":"2026-07-06T23:54:23.090538Z","submitted_at":"2026-06-17T13:13:32Z","title":"RODS: Reward-Driven Online Data Synthesis for Multi-Turn Tool-Use Agents","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-26T20:55:39.676641Z"},"links":{"citing_paper":"/paper/2606.19047"},"observation_digest":"sha256:32d257ccc795f249e7733e431f3cb097da66318924850076ba1c3d3e0d2191d7","observation_id":"73f13b9a-0c73-4720-831c-bc783b7f4c04","resolution":{"observed_at":"2026-06-26T20:55:39.676641Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.19047","last_updated":"2026-06-17T13:13:32Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-07-06T23:54:23.090538Z","submitted_at":"2026-06-17T13:13:32Z","title":"RODS: Reward-Driven Online Data Synthesis for Multi-Turn Tool-Use Agents"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":28,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 1 inbound Pith citation observation for arXiv:2606.19047."}