{"as_of":"2026-08-22T13:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:478e6f7ce547a2db966ebcc64238de08fc914db871796a56b4df1b1ad76f99ef","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T07:50:58.011407Z","state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.29568/citation-record","integrity":"/paper/2605.29568/integrity","json":"/paper/2605.29568/citation-record.json","paper":"/paper/2605.29568"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"files/1228896","doi":"10.18653/v1/2025.emnlp-main","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Stolfo, A., Balachandran, V ., Yousefi, S., Horvitz, E., and Nushi, B","venue":null,"work_id":"e8f5282f-30a2-4e6a-96fd-5aa884a0e8a0","year":2025},"citing_paper":{"arxiv_id":"2605.29568","last_updated":"2026-05-28T08:17:20Z","snapshot_observed_at":"2026-08-15T18:39:49.778946Z","submitted_at":"2026-05-28T08:17:20Z","title":"DeepTool: Scaling Interleaved Deliberation in Tool-Integrated Reasoning via Process-Supervised Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-29T07:50:58.011407Z"},"links":{"citing_paper":"/paper/2605.29568"},"observation_digest":"sha256:da921a9659708d752196f210d704a36b53490f16212fde20431d2451524b3395","observation_id":"32870d36-f24f-4f00-a03a-3658de4c4317","resolution":{"observed_at":"2026-06-29T07:53:13.148537Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-10T17:08:19.403756+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-10T17:08:19.403756+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.acl-long.702","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DRAGIN : Dynamic Retrieval Augmented Generation based on the Real-time Information Needs of Large Language Models","venue":null,"work_id":"8e899b44-710d-4567-8a32-6bd9a39fd5b7","year":2024},"citing_paper":{"arxiv_id":"2605.29568","last_updated":"2026-05-28T08:17:20Z","snapshot_observed_at":"2026-08-15T18:39:49.778946Z","submitted_at":"2026-05-28T08:17:20Z","title":"DeepTool: Scaling Interleaved Deliberation in Tool-Integrated Reasoning via Process-Supervised Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-29T07:50:58.011407Z"},"links":{"citing_paper":"/paper/2605.29568"},"observation_digest":"sha256:868c0a51676849bf395d41dabf7bf16ebac3662d366a33a136b46c3616852555","observation_id":"f7b6c3df-22de-4381-a560-5a1dd6675506","resolution":{"observed_at":"2026-06-29T07:53:13.150858Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-07-11T21:20:15.264816+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T21:20:15.264816+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T07:50:58.011407Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.29568","last_updated":"2026-05-28T08:17:20Z","snapshot_observed_at":"2026-08-15T18:39:49.778946Z","submitted_at":"2026-05-28T08:17:20Z","title":"DeepTool: Scaling Interleaved Deliberation in Tool-Integrated Reasoning via Process-Supervised Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-29T07:50:58.011407Z"},"links":{"citing_paper":"/paper/2605.29568"},"observation_digest":"sha256:00d51901f6d90e97891ac7634f054bfcb31c0afed9385af0f54f3a8742974a38","observation_id":"5cd38ede-8750-4813-990d-65809ee8b5e0","resolution":{"observed_at":"2026-06-29T07:50:58.011407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T07:50:58.011407Z","title":"Left side total weight (pounds):","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.29568","last_updated":"2026-05-28T08:17:20Z","snapshot_observed_at":"2026-08-15T18:39:49.778946Z","submitted_at":"2026-05-28T08:17:20Z","title":"DeepTool: Scaling Interleaved Deliberation in Tool-Integrated Reasoning via Process-Supervised Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-29T07:50:58.011407Z"},"links":{"citing_paper":"/paper/2605.29568"},"observation_digest":"sha256:b0cb8ee3b0b44b2ce2e2b5bda64775b79653ef3a3ffd48cbbe4e3b923255a188","observation_id":"cf192876-c7d5-49f7-afe0-98dc3009ca0f","resolution":{"observed_at":"2026-06-29T07:50:58.011407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T07:50:58.011407Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.29568","last_updated":"2026-05-28T08:17:20Z","snapshot_observed_at":"2026-08-15T18:39:49.778946Z","submitted_at":"2026-05-28T08:17:20Z","title":"DeepTool: Scaling Interleaved Deliberation in Tool-Integrated Reasoning via Process-Supervised Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-29T07:50:58.011407Z"},"links":{"citing_paper":"/paper/2605.29568"},"observation_digest":"sha256:218e6de03ae5d708e2833b8dd9b75215eee71d38aa82f2f2c14ce835ca538af9","observation_id":"bde07e99-e868-4a67-8013-bb7a2e61f192","resolution":{"observed_at":"2026-06-29T07:50:58.011407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T07:50:58.011407Z","title":"Compute right coefficient difference: (3/4)p - (1/3)p = -5/12p","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.29568","last_updated":"2026-05-28T08:17:20Z","snapshot_observed_at":"2026-08-15T18:39:49.778946Z","submitted_at":"2026-05-28T08:17:20Z","title":"DeepTool: Scaling Interleaved Deliberation in Tool-Integrated Reasoning via Process-Supervised Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-29T07:50:58.011407Z"},"links":{"citing_paper":"/paper/2605.29568"},"observation_digest":"sha256:36c702e37af2055f49cde9ac1510d0e804764de8006bf7d0c8246338e7d9db00","observation_id":"6e8e975a-4062-41b7-90d2-f9f928c6ff21","resolution":{"observed_at":"2026-06-29T07:50:58.011407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T07:50:58.011407Z","title":"Solve for p: p = -3/8 / -5/12","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.29568","last_updated":"2026-05-28T08:17:20Z","snapshot_observed_at":"2026-08-15T18:39:49.778946Z","submitted_at":"2026-05-28T08:17:20Z","title":"DeepTool: Scaling Interleaved Deliberation in Tool-Integrated Reasoning via Process-Supervised Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-29T07:50:58.011407Z"},"links":{"citing_paper":"/paper/2605.29568"},"observation_digest":"sha256:0adc7f1caf4178323d9bc55a9904794625d5b157bf3f3b39f3d8ba08b7d9e36e","observation_id":"ae29cfde-8860-46c8-9bdf-13b8024b00f9","resolution":{"observed_at":"2026-06-29T07:50:58.011407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T07:50:58.011407Z","title":"\": history =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.29568","last_updated":"2026-05-28T08:17:20Z","snapshot_observed_at":"2026-08-15T18:39:49.778946Z","submitted_at":"2026-05-28T08:17:20Z","title":"DeepTool: Scaling Interleaved Deliberation in Tool-Integrated Reasoning via Process-Supervised Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-29T07:50:58.011407Z"},"links":{"citing_paper":"/paper/2605.29568"},"observation_digest":"sha256:e323f9110ad5be514bd6102b34b4972892bba06695dadd62134c3cf0a9b589d4","observation_id":"cfeab547-4fe7-461b-8961-50ec610e6fa0","resolution":{"observed_at":"2026-06-29T07:50:58.011407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T07:50:58.011407Z","title":"\\\"\\\"{problem}\\","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.29568","last_updated":"2026-05-28T08:17:20Z","snapshot_observed_at":"2026-08-15T18:39:49.778946Z","submitted_at":"2026-05-28T08:17:20Z","title":"DeepTool: Scaling Interleaved Deliberation in Tool-Integrated Reasoning via Process-Supervised Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-29T07:50:58.011407Z"},"links":{"citing_paper":"/paper/2605.29568"},"observation_digest":"sha256:c7dee5eb4dadb18bba5f7d281ed64f4b3191fbc4dd2c1fe3b1ab3ba14288f12c","observation_id":"700c1301-1f83-4c34-9122-54647dcc4948","resolution":{"observed_at":"2026-06-29T07:50:58.011407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T07:50:58.011407Z","title":"\\\"\\\"{gold_cot}\\","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.29568","last_updated":"2026-05-28T08:17:20Z","snapshot_observed_at":"2026-08-15T18:39:49.778946Z","submitted_at":"2026-05-28T08:17:20Z","title":"DeepTool: Scaling Interleaved Deliberation in Tool-Integrated Reasoning via Process-Supervised Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-29T07:50:58.011407Z"},"links":{"citing_paper":"/paper/2605.29568"},"observation_digest":"sha256:e1cd090ee4eea57bbf221c98a5740151924944b230b1fc45d7f27a14f0442e03","observation_id":"4528c080-c472-44d8-a201-03f98966d63a","resolution":{"observed_at":"2026-06-29T07:50:58.011407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T07:50:58.011407Z","title":"\\\"\\\"{history}\\","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.29568","last_updated":"2026-05-28T08:17:20Z","snapshot_observed_at":"2026-08-15T18:39:49.778946Z","submitted_at":"2026-05-28T08:17:20Z","title":"DeepTool: Scaling Interleaved Deliberation in Tool-Integrated Reasoning via Process-Supervised Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-29T07:50:58.011407Z"},"links":{"citing_paper":"/paper/2605.29568"},"observation_digest":"sha256:f983597d5e67193412d62e7b7fba3629537333c8eef0eb993f49662935039b0e","observation_id":"05807164-469b-4183-b51d-003f6191736f","resolution":{"observed_at":"2026-06-29T07:50:58.011407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T07:50:58.011407Z","title":"Correction","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.29568","last_updated":"2026-05-28T08:17:20Z","snapshot_observed_at":"2026-08-15T18:39:49.778946Z","submitted_at":"2026-05-28T08:17:20Z","title":"DeepTool: Scaling Interleaved Deliberation in Tool-Integrated Reasoning via Process-Supervised Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-29T07:50:58.011407Z"},"links":{"citing_paper":"/paper/2605.29568"},"observation_digest":"sha256:088518033471f81ca594e98da07fb6821390ab95fd50f9de0dfd96c08d84a222","observation_id":"f72115e9-df42-4b50-89e6-3581fb3f9c87","resolution":{"observed_at":"2026-06-29T07:50:58.011407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T07:50:58.011407Z","title":"Correction","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.29568","last_updated":"2026-05-28T08:17:20Z","snapshot_observed_at":"2026-08-15T18:39:49.778946Z","submitted_at":"2026-05-28T08:17:20Z","title":"DeepTool: Scaling Interleaved Deliberation in Tool-Integrated Reasoning via Process-Supervised Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-29T07:50:58.011407Z"},"links":{"citing_paper":"/paper/2605.29568"},"observation_digest":"sha256:f19defeb6e6be028288c3b4d8b35bf1b4cdfd5769a5b279b7e60c21c005af28a","observation_id":"a18f4fb8-8eab-4699-a6e3-fe8910ad3216","resolution":{"observed_at":"2026-06-29T07:50:58.011407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T07:50:58.011407Z","title":"Correction","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.29568","last_updated":"2026-05-28T08:17:20Z","snapshot_observed_at":"2026-08-15T18:39:49.778946Z","submitted_at":"2026-05-28T08:17:20Z","title":"DeepTool: Scaling Interleaved Deliberation in Tool-Integrated Reasoning via Process-Supervised Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-29T07:50:58.011407Z"},"links":{"citing_paper":"/paper/2605.29568"},"observation_digest":"sha256:73aa09e68e2e7fc6807d68b32525bdf7ebb97560cfab0d0673ab97b742bd1ea8","observation_id":"542bf0f0-6053-4745-b1af-887d3cc2bee9","resolution":{"observed_at":"2026-06-29T07:50:58.011407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T07:50:58.011407Z","title":"\"\" else:# Intermediate task_instr =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.29568","last_updated":"2026-05-28T08:17:20Z","snapshot_observed_at":"2026-08-15T18:39:49.778946Z","submitted_at":"2026-05-28T08:17:20Z","title":"DeepTool: Scaling Interleaved Deliberation in Tool-Integrated Reasoning via Process-Supervised Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-29T07:50:58.011407Z"},"links":{"citing_paper":"/paper/2605.29568"},"observation_digest":"sha256:6776f62562b55ae61664c40fd402367b085962da92cc6aedd4375df8245f4d7d","observation_id":"7df2fc99-16b9-479a-afb0-fc99c8b8d38f","resolution":{"observed_at":"2026-06-29T07:50:58.011407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T07:50:58.011407Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.29568","last_updated":"2026-05-28T08:17:20Z","snapshot_observed_at":"2026-08-15T18:39:49.778946Z","submitted_at":"2026-05-28T08:17:20Z","title":"DeepTool: Scaling Interleaved Deliberation in Tool-Integrated Reasoning via Process-Supervised Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-29T07:50:58.011407Z"},"links":{"citing_paper":"/paper/2605.29568"},"observation_digest":"sha256:7a196a4ee46139ce15f901e415bf105f864bf42f9f400148899dd4793abb88e6","observation_id":"78a9b313-fe53-4a2f-9c3e-97f0371bd178","resolution":{"observed_at":"2026-06-29T07:50:58.011407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T07:50:58.011407Z","title":"\"\" ‘‘‘ returnf","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.29568","last_updated":"2026-05-28T08:17:20Z","snapshot_observed_at":"2026-08-15T18:39:49.778946Z","submitted_at":"2026-05-28T08:17:20Z","title":"DeepTool: Scaling Interleaved Deliberation in Tool-Integrated Reasoning via Process-Supervised Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-29T07:50:58.011407Z"},"links":{"citing_paper":"/paper/2605.29568"},"observation_digest":"sha256:f88d085ad70f772e75855430a3940b94f86c7c5fcf688b2545388a5c584c306b","observation_id":"d7801010-966c-4709-b622-76716ac0a256","resolution":{"observed_at":"2026-06-29T07:50:58.011407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T07:50:58.011407Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.29568","last_updated":"2026-05-28T08:17:20Z","snapshot_observed_at":"2026-08-15T18:39:49.778946Z","submitted_at":"2026-05-28T08:17:20Z","title":"DeepTool: Scaling Interleaved Deliberation in Tool-Integrated Reasoning via Process-Supervised Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-29T07:50:58.011407Z"},"links":{"citing_paper":"/paper/2605.29568"},"observation_digest":"sha256:b9f0f27e14e571357589c0902dffc9e6e8b81b4edd90b80a82a324c0352509b4","observation_id":"9b89a2a8-b551-4508-aa3e-c8f6038dfd79","resolution":{"observed_at":"2026-06-29T07:50:58.011407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T07:50:58.011407Z","title":"Analyze output","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.29568","last_updated":"2026-05-28T08:17:20Z","snapshot_observed_at":"2026-08-15T18:39:49.778946Z","submitted_at":"2026-05-28T08:17:20Z","title":"DeepTool: Scaling Interleaved Deliberation in Tool-Integrated Reasoning via Process-Supervised Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-29T07:50:58.011407Z"},"links":{"citing_paper":"/paper/2605.29568"},"observation_digest":"sha256:1a50475405ec86af45a69d9c84fbabc0f1163d7449c736fbeebc86c76ca6a2eb","observation_id":"8de4e78e-c9a8-4a44-9da1-16b7d4555758","resolution":{"observed_at":"2026-06-29T07:50:58.011407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T07:50:58.011407Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.29568","last_updated":"2026-05-28T08:17:20Z","snapshot_observed_at":"2026-08-15T18:39:49.778946Z","submitted_at":"2026-05-28T08:17:20Z","title":"DeepTool: Scaling Interleaved Deliberation in Tool-Integrated Reasoning via Process-Supervised Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-29T07:50:58.011407Z"},"links":{"citing_paper":"/paper/2605.29568"},"observation_digest":"sha256:e433b2f78a6460a9f79dd2ff292d40ac497e6ea004f498a9b6e6cff54fa507dd","observation_id":"ffbafc74-282a-4a79-938f-fafe020af81f","resolution":{"observed_at":"2026-06-29T07:50:58.011407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T07:50:58.011407Z","title":"\"\" Listing 4.Prompt for Baseline Trajectory Synthesis Method defgenerate_baseline_prompt(question:str) ->str: returnf","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.29568","last_updated":"2026-05-28T08:17:20Z","snapshot_observed_at":"2026-08-15T18:39:49.778946Z","submitted_at":"2026-05-28T08:17:20Z","title":"DeepTool: Scaling Interleaved Deliberation in Tool-Integrated Reasoning via Process-Supervised Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-29T07:50:58.011407Z"},"links":{"citing_paper":"/paper/2605.29568"},"observation_digest":"sha256:222b1591c7ebaddf93af9498f7576e54812296a66bd1a4ba777b820726a1d69d","observation_id":"44cb438f-d561-439a-8136-48e4a747ed1e","resolution":{"observed_at":"2026-06-29T07:50:58.011407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2605.29568","last_updated":"2026-05-28T08:17:20Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-15T18:39:49.778946Z","submitted_at":"2026-05-28T08:17:20Z","title":"DeepTool: Scaling Interleaved Deliberation in Tool-Integrated Reasoning via Process-Supervised Reinforcement Learning"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":19,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 0 inbound Pith citation observations for arXiv:2605.29568."}