{"as_of":"2026-08-09T21:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ee529a0e8255427481d0874e52174b3e8dadeaf50d1c643aff75b679e47da5b2","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:41:48.421514Z","state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":16,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T10:20:42.130163Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-22T06:24:40.465949Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.12928","snapshot_observed_at":"2026-08-05T20:17:13.855017Z","title":"Scaling test-time compute for llm agents, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.10874","last_updated":"2025-08-14T17:46:01Z","snapshot_observed_at":"2026-08-06T03:19:32.559275Z","submitted_at":"2025-08-14T17:46:01Z","title":"SSRL: Self-Search Reinforcement Learning","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-05T20:17:13.855017Z"},"links":{"cited_paper":"/paper/2506.12928","citing_paper":"/paper/2508.10874"},"observation_digest":"sha256:a6220c9b69f3a65e74040508638d1338728709549237e1a8b0cc417bd8cd2001","observation_id":"c74b1a72-ace6-4ffb-8732-1be03af50989","resolution":{"observed_at":"2026-08-05T20:17:13.855017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.12928","snapshot_observed_at":"2026-08-05T23:57:37.738674Z","title":"Scaling test- time compute for llm agents, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.13167","last_updated":"2025-08-06T17:01:02Z","snapshot_observed_at":"2026-08-05T23:57:29.481263Z","submitted_at":"2025-08-06T17:01:02Z","title":"Chain-of-Agents: End-to-End Agent Foundation Models via Multi-Agent Distillation and Agentic RL","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-05T23:57:37.738674Z"},"links":{"cited_paper":"/paper/2506.12928","citing_paper":"/paper/2508.13167"},"observation_digest":"sha256:b2931351f364422a3eed9e67225298bd41f84d50e560124e6a99841428a16a4b","observation_id":"4bc80da3-53d8-4761-b32d-2fd4cf67c913","resolution":{"observed_at":"2026-08-05T23:57:37.738674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"cited_work":{"arxiv_id":"2506.12928","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.12928","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scaling test-time compute for LLM agents","venue":null,"work_id":"addf05cd-37c8-430c-afe8-e4050710cf61","year":2025},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":176,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"cited_paper":"/paper/2506.12928","citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:37f4716af3d74c64edec2b7194036467cc86b6da85f978913534fae0cad4aac9","observation_id":"e3642bd2-4c47-4b87-893b-f479cf8520fd","resolution":{"observed_at":"2026-05-11T12:26:05.399233Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"cited_work":{"arxiv_id":"2506.12928","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.12928","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scaling test-time compute for LLM agents","venue":null,"work_id":"addf05cd-37c8-430c-afe8-e4050710cf61","year":2025},"citing_paper":{"arxiv_id":"2605.05701","last_updated":"2026-05-07T05:45:58Z","snapshot_observed_at":"2026-08-06T17:07:50.920537Z","submitted_at":"2026-05-07T05:45:58Z","title":"Inference-Time Budget Control for LLM Search Agents","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-08T11:51:02.872129Z"},"links":{"cited_paper":"/paper/2506.12928","citing_paper":"/paper/2605.05701"},"observation_digest":"sha256:b7b52a9798488ec1e89d9117a475b6cc5c7a6120305e11e87845158e2c7f7b2f","observation_id":"782feeaa-f415-49e3-a1e3-c9b58861e895","resolution":{"observed_at":"2026-05-11T19:31:07.932732Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"cited_work":{"arxiv_id":"2506.12928","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.12928","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scaling test-time compute for LLM agents","venue":null,"work_id":"addf05cd-37c8-430c-afe8-e4050710cf61","year":2025},"citing_paper":{"arxiv_id":"2605.09121","last_updated":"2026-05-09T19:14:33Z","snapshot_observed_at":"2026-08-08T19:11:23.018391Z","submitted_at":"2026-05-09T19:14:33Z","title":"A Communication-Theoretic Framework for LLM Agents: Cost-Aware Adaptive Reliability","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-05-12T03:03:05.715652Z"},"links":{"cited_paper":"/paper/2506.12928","citing_paper":"/paper/2605.09121"},"observation_digest":"sha256:33bff2e3242d7d6227673465517f82c3e1f97d01f77fe5ce72cecb533f9fd450","observation_id":"4aea3837-ef7b-40e2-a7d4-23fcc92696ec","resolution":{"observed_at":"2026-05-12T03:06:19.459616Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"cited_work":{"arxiv_id":"2506.12928","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.12928","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scaling test-time compute for LLM agents","venue":null,"work_id":"addf05cd-37c8-430c-afe8-e4050710cf61","year":2025},"citing_paper":{"arxiv_id":"2605.11039","last_updated":"2026-05-11T04:09:11Z","snapshot_observed_at":"2026-07-06T23:22:57.012338Z","submitted_at":"2026-05-11T04:09:11Z","title":"The Granularity Mismatch in Agent Security: Argument-Level Provenance Solves Enforcement and Isolates the LLM Reasoning Bottleneck","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-13T01:31:13.100257Z"},"links":{"cited_paper":"/paper/2506.12928","citing_paper":"/paper/2605.11039"},"observation_digest":"sha256:5bd8286ace102a2f92ba3e47ee68c918d15ae7209b093dc88ab01af51d770349","observation_id":"aece34da-0f04-4b99-9b93-dce8ded68d13","resolution":{"observed_at":"2026-05-13T01:32:02.859506Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"cited_work":{"arxiv_id":"2506.12928","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.12928","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scaling test-time compute for LLM agents","venue":null,"work_id":"addf05cd-37c8-430c-afe8-e4050710cf61","year":2025},"citing_paper":{"arxiv_id":"2605.14037","last_updated":"2026-05-13T18:58:16Z","snapshot_observed_at":"2026-08-04T00:53:16.855757Z","submitted_at":"2026-05-13T18:58:16Z","title":"Self-Pruned Key-Value Attention: Learning When to Write by Predicting Future Utility","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-05-15T05:35:09.705532Z"},"links":{"cited_paper":"/paper/2506.12928","citing_paper":"/paper/2605.14037"},"observation_digest":"sha256:5642a73cb0c39f67f7f46e0c13c5ad58ccf945ace375c93960f90b082bf88523","observation_id":"02bd3d7b-4e54-42c7-bf88-5668d8ebdc51","resolution":{"observed_at":"2026-05-15T05:39:47.911666Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"cited_work":{"arxiv_id":"2506.12928","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.12928","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scaling test-time compute for LLM agents","venue":null,"work_id":"addf05cd-37c8-430c-afe8-e4050710cf61","year":2025},"citing_paper":{"arxiv_id":"2605.17320","last_updated":"2026-05-17T08:24:01Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T08:24:01Z","title":"TClone: Low-Latency Forking of Live GUI Environments for Computer-Use Agents","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-19T22:55:28.637039Z"},"links":{"cited_paper":"/paper/2506.12928","citing_paper":"/paper/2605.17320"},"observation_digest":"sha256:599faf4e569161501e0dfc4e5761bfc023de909d21becf2afd555e4ab20d27d9","observation_id":"5640f2b7-5067-48bb-87a6-90f722a0c543","resolution":{"observed_at":"2026-05-19T22:57:50.188959Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"cited_work":{"arxiv_id":"2506.12928","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.12928","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scaling test-time compute for LLM agents","venue":null,"work_id":"addf05cd-37c8-430c-afe8-e4050710cf61","year":2025},"citing_paper":{"arxiv_id":"2605.22102","last_updated":"2026-05-21T07:38:44Z","snapshot_observed_at":"2026-08-04T12:38:56.645269Z","submitted_at":"2026-05-21T07:38:44Z","title":"ExComm: Exploration-Stage Communication for Error-Resilient Agentic Test-Time Scaling","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-22T05:54:12.458110Z"},"links":{"cited_paper":"/paper/2506.12928","citing_paper":"/paper/2605.22102"},"observation_digest":"sha256:c8d62f69dfaf8c00c96b919556cad99009c7cbdafbe4566617282cfc4e00f2c6","observation_id":"cd3253b7-eea2-4e30-9d1b-8a9bfee353ef","resolution":{"observed_at":"2026-05-22T05:54:38.586904Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"cited_work":{"arxiv_id":"2506.12928","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.12928","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scaling test-time compute for LLM agents","venue":null,"work_id":"addf05cd-37c8-430c-afe8-e4050710cf61","year":2025},"citing_paper":{"arxiv_id":"2605.22154","last_updated":"2026-05-21T08:25:17Z","snapshot_observed_at":"2026-07-30T19:02:11.122375Z","submitted_at":"2026-05-21T08:25:17Z","title":"IdleSpec: Exploiting Idle Time via Speculative Planning for LLM Agents","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-22T06:21:56.971204Z"},"links":{"cited_paper":"/paper/2506.12928","citing_paper":"/paper/2605.22154"},"observation_digest":"sha256:a50e3c04183353aea4422beaad8da2928813e720f588906be4816c20020da6e3","observation_id":"9847c3d3-f2bf-4878-bfff-f2fbe9fefaa5","resolution":{"observed_at":"2026-05-22T06:24:40.468558Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.12928","snapshot_observed_at":"2026-08-04T00:43:21.854604Z","title":"Scaling test-time compute for LLM agents.arXiv preprint arXiv:2506.12928,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00355","last_updated":"2026-07-31T23:58:25Z","snapshot_observed_at":"2026-08-08T11:51:27.464331Z","submitted_at":"2026-07-31T23:58:25Z","title":"CurveShift: Is Agent Progress Scalar? Separating Level from Shape","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T00:43:21.854604Z"},"links":{"cited_paper":"/paper/2506.12928","citing_paper":"/paper/2608.00355"},"observation_digest":"sha256:758eb1b3b245f277276dfa9ab7a20edacece43a89e5963c88622037f7822fbc1","observation_id":"9e91e587-47b1-422f-9eaf-0e96bb217707","resolution":{"observed_at":"2026-08-04T00:43:21.854604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.12928","snapshot_observed_at":"2026-08-06T00:24:22.837114Z","title":"Scaling test-time compute for llm agents.arXiv preprint arXiv:2506.12928, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01319","last_updated":"2026-08-02T15:41:12Z","snapshot_observed_at":"2026-08-08T23:24:10.981579Z","submitted_at":"2026-08-02T15:41:12Z","title":"Cognitive Demand Steering for Adaptive Meta-Reasoning in Large Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T00:24:22.837114Z"},"links":{"cited_paper":"/paper/2506.12928","citing_paper":"/paper/2608.01319"},"observation_digest":"sha256:121fbc9840796d458bc47c5f050174046119bbecd46b4c01fb11a3319d13e1b1","observation_id":"7921223b-3ee0-4633-9e0a-af2fe5e9b1f8","resolution":{"observed_at":"2026-08-06T00:24:22.837114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.12928","snapshot_observed_at":"2026-08-04T19:21:37.747063Z","title":"Current Step","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01867","last_updated":"2026-08-04T02:03:12Z","snapshot_observed_at":"2026-08-08T14:47:27.354205Z","submitted_at":"2026-08-03T08:15:18Z","title":"CRISP: Critical Step Perception for Training Efficient Deep Search Agents","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T19:21:37.747063Z"},"links":{"cited_paper":"/paper/2506.12928","citing_paper":"/paper/2608.01867"},"observation_digest":"sha256:b8b82bc310b0a6cbbff26fc8c3be7bcd51d31a006656229ad6b8efcfb919dbd6","observation_id":"41ae6c14-ffbc-4112-9389-4ca2b5dde8ee","resolution":{"observed_at":"2026-08-04T19:21:37.747063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.12928","snapshot_observed_at":"2026-08-07T00:13:41.203958Z","title":"Current Step","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01867","last_updated":"2026-08-04T02:03:12Z","snapshot_observed_at":"2026-08-08T14:47:27.354205Z","submitted_at":"2026-08-03T08:15:18Z","title":"CRISP: Critical Step Perception for Training Efficient Deep Search Agents","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:41.203958Z"},"links":{"cited_paper":"/paper/2506.12928","citing_paper":"/paper/2608.01867"},"observation_digest":"sha256:3caeea28d2e6db01f46188a75c4054f5337aadffcdd61fed91e2baf631ac135e","observation_id":"e883c10c-9899-4482-8c63-faedb87f389e","resolution":{"observed_at":"2026-08-07T00:13:41.203958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.12928","snapshot_observed_at":"2026-08-05T04:26:29.391821Z","title":"E.; Zhang, C.; Lin, C.; Wang, J.; Zhang, G.; and Zhou, W","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02636","last_updated":"2026-07-31T04:02:51Z","snapshot_observed_at":"2026-08-09T14:34:24.393371Z","submitted_at":"2026-07-31T04:02:51Z","title":"Rethinking Self-Evolving Agent Skills: Feedback Dynamics over Multiple Rounds","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-05T04:26:29.391821Z"},"links":{"cited_paper":"/paper/2506.12928","citing_paper":"/paper/2608.02636"},"observation_digest":"sha256:427566e42e2f76694152b78cd7341310cbec9b4d1805e35acada24761eb97b5a","observation_id":"ddbf3e45-f320-4df8-b7ba-3f42e3441114","resolution":{"observed_at":"2026-08-05T04:26:29.391821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.12928","snapshot_observed_at":"2026-08-08T10:20:42.130163Z","title":"E.; Zhang, C.; Lin, C.; Wang, J.; Zhang, G.; and Zhou, W","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05573","last_updated":"2026-08-06T03:52:37Z","snapshot_observed_at":"2026-08-09T20:11:20.447758Z","submitted_at":"2026-08-06T03:52:37Z","title":"SkillTV-Bench: Benchmarking How Well Judges Perform on Skill-Augmented Agentic Execution","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-08T10:20:42.130163Z"},"links":{"cited_paper":"/paper/2506.12928","citing_paper":"/paper/2608.05573"},"observation_digest":"sha256:3da09eab2a3a431f901564ce13d7d9627e2b5095d24f18875e92ceb75d4edd2f","observation_id":"3e914543-90f7-4f96-bbdc-5af9c64d2bb7","resolution":{"observed_at":"2026-08-08T10:20:42.130163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.12928/citation-record","integrity":"/paper/2506.12928/integrity","json":"/paper/2506.12928/citation-record.json","paper":"/paper/2506.12928"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:49.371853Z","title":null,"venue":null,"work_id":"1cdb13c1-15fb-411d-997c-3d4c1e92765f","year":2025},"citing_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:48.279342Z"},"links":{"citing_paper":"/paper/2506.12928"},"observation_digest":"sha256:88844cc38bba44e44a69d2d9d63d55b11b6b3e93ebc4bc4d22e04d47d77b75e3","observation_id":"ead75c48-fe3f-489f-b8b7-8104120d74c8","resolution":{"observed_at":"2026-08-07T00:41:49.377187Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08445","last_updated":"2024-12-11T15:09:54Z","snapshot_observed_at":"2026-08-07T02:30:11.325557Z","submitted_at":"2024-12-11T15:09:54Z","title":"TapeAgents: a Holistic Framework for Agent Development and Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08445","snapshot_observed_at":"2026-08-07T00:41:48.283939Z","title":"Bahdanau, N","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:48.283939Z"},"links":{"cited_paper":"/paper/2412.08445","citing_paper":"/paper/2506.12928"},"observation_digest":"sha256:9817438a17c0e39db875163908bad359670397f2cdf6626243b4e120c5459a92","observation_id":"f453d572-e8d7-42f0-b855-03bab1520a0b","resolution":{"observed_at":"2026-08-07T00:41:48.283939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:49.355998Z","title":"Beeching, L","venue":null,"work_id":"7ac484d3-28c2-4dab-b552-472440699489","year":2024},"citing_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:48.288676Z"},"links":{"citing_paper":"/paper/2506.12928"},"observation_digest":"sha256:2bb543f79d36b96c035b40fc7a22b07fcc79ef086f5601494f427752b4fce029","observation_id":"16d899cb-5f15-49f7-84dd-93289ab9351c","resolution":{"observed_at":"2026-08-07T00:41:49.360522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:48.293050Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:48.293050Z"},"links":{"citing_paper":"/paper/2506.12928"},"observation_digest":"sha256:0be9724200435979fb6a30157603d9b12523c3648eafd4b12d0bdaecbf47b42a","observation_id":"5e5c012c-e752-40d3-b687-f9e5a26ffd5c","resolution":{"observed_at":"2026-08-07T00:41:48.293050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:49.341369Z","title":null,"venue":null,"work_id":"f8ba1012-5029-443a-9567-f82d5d2fd2a7","year":2025},"citing_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:48.297183Z"},"links":{"citing_paper":"/paper/2506.12928"},"observation_digest":"sha256:1b4c8024857bcf59a2ac4f1df4132a18f7f856e9ed74252dc0f68aca0397d8d9","observation_id":"f08d72e9-e786-4ef7-ae03-19a4b8ca0356","resolution":{"observed_at":"2026-08-07T00:41:49.345844Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:48.301350Z","title":"Faria and N","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:48.301350Z"},"links":{"citing_paper":"/paper/2506.12928"},"observation_digest":"sha256:b84b5e87f9dbf3fa794e7e137d0d8dbdd1825b20c79345fbae284610076e6bdf","observation_id":"959bf115-9cbd-424c-b39b-23232d1d270a","resolution":{"observed_at":"2026-08-07T00:41:48.301350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04468","last_updated":"2024-11-07T06:36:19Z","snapshot_observed_at":"2026-08-04T17:52:28.620519Z","submitted_at":"2024-11-07T06:36:19Z","title":"Magentic-One: A Generalist Multi-Agent System for Solving Complex Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04468","snapshot_observed_at":"2026-08-07T00:41:48.306102Z","title":"Fourney, G","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:48.306102Z"},"links":{"cited_paper":"/paper/2411.04468","citing_paper":"/paper/2506.12928"},"observation_digest":"sha256:bd4cf7b3f699c551e6436809c33aa54b886be08aed64d145f308bcc06077bcf1","observation_id":"9e291ef7-b138-4076-91b6-2f0d96ab0c20","resolution":{"observed_at":"2026-08-07T00:41:48.306102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T00:41:48.310739Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:48.310739Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.12928"},"observation_digest":"sha256:03276520945480bea6d0e849a1f37e602cd648bf4162eb09f39cacc551aae8ed","observation_id":"c2331d8e-077d-446b-98f9-f65c1da3dc75","resolution":{"observed_at":"2026-08-07T00:41:48.310739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.00352","last_updated":"2024-11-01T14:36:52Z","snapshot_observed_at":"2026-07-06T16:01:07.532053Z","submitted_at":"2023-08-01T07:49:10Z","title":"MetaGPT: Meta Programming for A Multi-Agent Collaborative Framework","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.00352","snapshot_observed_at":"2026-08-07T00:41:48.319126Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:48.319126Z"},"links":{"cited_paper":"/paper/2308.00352","citing_paper":"/paper/2506.12928"},"observation_digest":"sha256:2958d6f2504127383dfb8ce780daee314f4ea0c038fe1f4ea8ec37393c87057e","observation_id":"1684e9e7-5946-4bd6-b138-2cc313d9364c","resolution":{"observed_at":"2026-08-07T00:41:48.319126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-07T00:41:48.323210Z","title":"Jaech, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:48.323210Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2506.12928"},"observation_digest":"sha256:d51c408675bb9921b76536b895d9d879068876af6c420710ca7bbcba17597730","observation_id":"3ca74235-d0d8-4eae-807c-f11b019e2462","resolution":{"observed_at":"2026-08-07T00:41:48.323210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13649","last_updated":"2024-06-06T02:01:09Z","snapshot_observed_at":"2026-08-05T16:01:54.847394Z","submitted_at":"2024-01-24T18:35:21Z","title":"VisualWebArena: Evaluating Multimodal Agents on Realistic Visual Web Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13649","snapshot_observed_at":"2026-08-07T00:41:48.327648Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:48.327648Z"},"links":{"cited_paper":"/paper/2401.13649","citing_paper":"/paper/2506.12928"},"observation_digest":"sha256:28d8b1a0cafeb514ae2e21d48be74fdacc974deb14cb2d4e329a40299883e8c0","observation_id":"c63f3175-2472-4843-9ce2-89045992f51e","resolution":{"observed_at":"2026-08-07T00:41:48.327648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:48.331771Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:48.331771Z"},"links":{"citing_paper":"/paper/2506.12928"},"observation_digest":"sha256:4a7fd46372e6a41197e51db1764c971c2b97a771899e32b061cb22bd01a8f068","observation_id":"1288602c-0046-48da-bdbc-eaa49d75aa3a","resolution":{"observed_at":"2026-08-07T00:41:48.331771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12917","last_updated":"2024-10-04T17:28:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-19T17:16:21Z","title":"Training Language Models to Self-Correct via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12917","snapshot_observed_at":"2026-08-07T00:41:48.335591Z","title":"Kumar, V","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:48.335591Z"},"links":{"cited_paper":"/paper/2409.12917","citing_paper":"/paper/2506.12928"},"observation_digest":"sha256:d2c5bfef296868824264d90a6f7630a0ad44987ffab77a086dfb46854e72b504","observation_id":"439ff490-1b63-40a1-866d-b56c2015fab4","resolution":{"observed_at":"2026-08-07T00:41:48.335591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:49.326243Z","title":null,"venue":null,"work_id":"a3a9b0df-fe21-4aec-a78a-186dea7aedcb","year":2025},"citing_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:48.339706Z"},"links":{"citing_paper":"/paper/2506.12928"},"observation_digest":"sha256:0c112f9b3bc59f804fdb0415d46d8d3e09175d92110d0854f97552cf972ade4a","observation_id":"21827c23-70e0-4de2-9183-1a3345be1115","resolution":{"observed_at":"2026-08-07T00:41:49.330821Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.05366","last_updated":"2025-01-09T16:48:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-09T16:48:17Z","title":"Search-o1: Agentic Search-Enhanced Large Reasoning Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.05366","snapshot_observed_at":"2026-08-07T00:41:48.343427Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:48.343427Z"},"links":{"cited_paper":"/paper/2501.05366","citing_paper":"/paper/2506.12928"},"observation_digest":"sha256:f6dba3c5ce58be25954bb5aafea2828de6756853d8acf8e7957f3abb5236b7cc","observation_id":"ebd40cb0-8f36-42fb-889f-eaa512995a70","resolution":{"observed_at":"2026-08-07T00:41:48.343427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.21776","last_updated":"2025-10-13T12:40:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-30T16:25:25Z","title":"WebThinker: Empowering Large Reasoning Models with Deep Research Capability","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.21776","snapshot_observed_at":"2026-08-07T00:41:48.347863Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:48.347863Z"},"links":{"cited_paper":"/paper/2504.21776","citing_paper":"/paper/2506.12928"},"observation_digest":"sha256:529bcc5b3d871d740203653d7687526b72ed8e08769c2874a3534f13540e3f45","observation_id":"6d691e17-8845-48d9-9b29-8ad550720560","resolution":{"observed_at":"2026-08-07T00:41:48.347863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:48.352324Z","title":"Liang, J","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:48.352324Z"},"links":{"citing_paper":"/paper/2506.12928"},"observation_digest":"sha256:c77e426b95317d3d18fae4f0bb5e48c76b0130b6d0b29eb6e948d93c80a13690","observation_id":"fb48ef7b-99d4-4531-ab86-8dda35c847a0","resolution":{"observed_at":"2026-08-07T00:41:48.352324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07191","last_updated":"2025-02-17T03:54:05Z","snapshot_observed_at":"2026-08-09T05:18:33.083500Z","submitted_at":"2025-02-11T02:31:11Z","title":"Bag of Tricks for Inference-time Computation of LLM Reasoning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.07191","snapshot_observed_at":"2026-08-07T00:41:48.356267Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:48.356267Z"},"links":{"cited_paper":"/paper/2502.07191","citing_paper":"/paper/2506.12928"},"observation_digest":"sha256:2a268d7cd3218c4c12606dcc9c6dd24c66c22a2412614e0f510f5b7677568fba","observation_id":"e893122c-ad37-4a27-a137-ea9315d31a5f","resolution":{"observed_at":"2026-08-07T00:41:48.356267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06703","last_updated":"2025-02-10T17:30:23Z","snapshot_observed_at":"2026-08-08T18:40:06.157350Z","submitted_at":"2025-02-10T17:30:23Z","title":"Can 1B LLM Surpass 405B LLM? Rethinking Compute-Optimal Test-Time Scaling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06703","snapshot_observed_at":"2026-08-07T00:41:48.364617Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:48.364617Z"},"links":{"cited_paper":"/paper/2502.06703","citing_paper":"/paper/2506.12928"},"observation_digest":"sha256:ae655fdf27d1de903cd42a7a153f3f3bc1a822f32de1b2287afebfa97afb8785","observation_id":"b527d30a-272e-4fb3-9d5c-64ecec4f111a","resolution":{"observed_at":"2026-08-07T00:41:48.364617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:49.311690Z","title":"Mialon, C","venue":null,"work_id":"938f133d-1cb6-4f16-98c7-1ec4fe262842","year":2023},"citing_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:48.368652Z"},"links":{"citing_paper":"/paper/2506.12928"},"observation_digest":"sha256:2167025a8cd351030a8aabed9f0a6cce5bb122b67de1a2933bf7528b6919b9cb","observation_id":"8de97828-6ac3-4f9c-ad77-8a44bb69ece8","resolution":{"observed_at":"2026-08-07T00:41:49.315918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13958","last_updated":"2025-04-16T21:45:32Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-16T21:45:32Z","title":"ToolRL: Reward is All Tool Learning Needs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.13958","snapshot_observed_at":"2026-08-07T00:41:48.372875Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:48.372875Z"},"links":{"cited_paper":"/paper/2504.13958","citing_paper":"/paper/2506.12928"},"observation_digest":"sha256:bf7483770ddd70feb4eecd07a172df14f97ab0726417167e45a02f16eab18456","observation_id":"f4ae9f3d-3792-4c18-b3d9-f7059aff5258","resolution":{"observed_at":"2026-08-07T00:41:48.372875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:49.295210Z","title":"repository","venue":null,"work_id":"3e3d850b-96b8-427c-a7e7-a71d1f220a2b","year":2022},"citing_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:48.376819Z"},"links":{"citing_paper":"/paper/2506.12928"},"observation_digest":"sha256:a8a4c3ca63365fc2a7f7e5072ae65f69e0c1f923743870c03ad17210e4469028","observation_id":"30d0d066-64fe-407f-b1f6-1820f5f7e9c8","resolution":{"observed_at":"2026-08-07T00:41:49.300615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03314","snapshot_observed_at":"2026-08-07T00:41:48.380796Z","title":"Snell, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:48.380796Z"},"links":{"cited_paper":"/paper/2408.03314","citing_paper":"/paper/2506.12928"},"observation_digest":"sha256:bcad1fbacb3d970dec8037468105cf3a19acee64c1f2726a237fee6232a8d236","observation_id":"7d703542-bcf2-4533-851b-c7559cc76899","resolution":{"observed_at":"2026-08-07T00:41:48.380796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:48.384860Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:48.384860Z"},"links":{"citing_paper":"/paper/2506.12928"},"observation_digest":"sha256:feda1020d7bb34b4417b9420ac1a673c9fe088ce2d5286d802f6e1d1fdad27bb","observation_id":"84872660-fed1-423e-b193-bf34ebd254ca","resolution":{"observed_at":"2026-08-07T00:41:48.384860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13639","last_updated":"2024-10-22T22:05:16Z","snapshot_observed_at":"2026-08-07T03:12:05.820669Z","submitted_at":"2024-10-17T15:09:03Z","title":"A Comparative Study on Reasoning Patterns of OpenAI's o1 Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13639","snapshot_observed_at":"2026-08-07T00:41:48.388696Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:48.388696Z"},"links":{"cited_paper":"/paper/2410.13639","citing_paper":"/paper/2506.12928"},"observation_digest":"sha256:4e6a1b2f13c21f367cb53fd3c844497026524125783ebad5ea1df8e0ed56cd0a","observation_id":"929e9e6b-b2dc-4f8c-90d0-fff4808e710f","resolution":{"observed_at":"2026-08-07T00:41:48.388696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00724","last_updated":"2025-03-03T07:53:32Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-01T17:16:04Z","title":"Inference Scaling Laws: An Empirical Analysis of Compute-Optimal Inference for Problem-Solving with Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00724","snapshot_observed_at":"2026-08-07T00:41:48.397018Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:48.397018Z"},"links":{"cited_paper":"/paper/2408.00724","citing_paper":"/paper/2506.12928"},"observation_digest":"sha256:f3cf6d98a4d0154c265994c8cbbce2770dd9e2c1ae31e4936b7484492caf37c0","observation_id":"dc793ea2-6375-4da3-84d0-54abef17e3a4","resolution":{"observed_at":"2026-08-07T00:41:48.397018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07456","last_updated":"2024-02-15T09:30:48Z","snapshot_observed_at":"2026-08-08T22:28:54.714585Z","submitted_at":"2024-02-12T07:29:22Z","title":"OS-Copilot: Towards Generalist Computer Agents with Self-Improvement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07456","snapshot_observed_at":"2026-08-07T00:41:48.400792Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:48.400792Z"},"links":{"cited_paper":"/paper/2402.07456","citing_paper":"/paper/2506.12928"},"observation_digest":"sha256:3610b195c8e44ab686d9414fb4df653632fc29e3df81e0da98b68cf7e04dd499","observation_id":"2bc32b7b-4c2f-49be-a1ba-f3b1bd33099b","resolution":{"observed_at":"2026-08-07T00:41:48.400792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19613","last_updated":"2025-02-26T23:01:16Z","snapshot_observed_at":"2026-08-07T17:44:42.205124Z","submitted_at":"2025-02-26T23:01:16Z","title":"Self-rewarding correction for mathematical reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19613","snapshot_observed_at":"2026-08-07T00:41:48.404875Z","title":"Xiong, H","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:48.404875Z"},"links":{"cited_paper":"/paper/2502.19613","citing_paper":"/paper/2506.12928"},"observation_digest":"sha256:5c98202bc6dac7172cea1b0ff186e1670f8f1d1e7920e747863fafe819bb755a","observation_id":"97f62b28-d998-499f-aa58-9eb0923c1a72","resolution":{"observed_at":"2026-08-07T00:41:48.404875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13854","last_updated":"2024-04-16T15:13:18Z","snapshot_observed_at":"2026-08-06T12:47:01.809185Z","submitted_at":"2023-07-25T22:59:32Z","title":"WebArena: A Realistic Web Environment for Building Autonomous Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13854","snapshot_observed_at":"2026-08-07T00:41:48.409072Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:48.409072Z"},"links":{"cited_paper":"/paper/2307.13854","citing_paper":"/paper/2506.12928"},"observation_digest":"sha256:cd3074c164b0c5eba37012f4c365116bb2927e457c4298d33cfe7643f22ee21c","observation_id":"60284b91-56cd-4e56-bbea-0ef459298217","resolution":{"observed_at":"2026-08-07T00:41:48.409072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13304","last_updated":"2023-05-22T17:58:10Z","snapshot_observed_at":"2026-08-01T10:39:25.620758Z","submitted_at":"2023-05-22T17:58:10Z","title":"RecurrentGPT: Interactive Generation of (Arbitrarily) Long Text","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13304","snapshot_observed_at":"2026-08-07T00:41:48.413118Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:48.413118Z"},"links":{"cited_paper":"/paper/2305.13304","citing_paper":"/paper/2506.12928"},"observation_digest":"sha256:7af9ec5568d47b3a1957222353f7a6ca11d0f0ec538401ee0c80f9434ab10ca6","observation_id":"8d6593bd-d119-42e1-9cf7-7f035bae4949","resolution":{"observed_at":"2026-08-07T00:41:48.413118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07870","last_updated":"2023-12-12T04:47:21Z","snapshot_observed_at":"2026-07-06T16:18:37.399390Z","submitted_at":"2023-09-14T17:18:25Z","title":"Agents: An Open-source Framework for Autonomous Language Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07870","snapshot_observed_at":"2026-08-07T00:41:48.417200Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:48.417200Z"},"links":{"cited_paper":"/paper/2309.07870","citing_paper":"/paper/2506.12928"},"observation_digest":"sha256:709ec22855143619fd01c9b4e13f641416d3589b7634beb8f756908848b4b4a9","observation_id":"524c4b4f-084c-431f-bb09-1a10a6336551","resolution":{"observed_at":"2026-08-07T00:41:48.417200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18532","last_updated":"2024-06-26T17:59:18Z","snapshot_observed_at":"2026-08-09T13:24:33.280267Z","submitted_at":"2024-06-26T17:59:18Z","title":"Symbolic Learning Enables Self-Evolving Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18532","snapshot_observed_at":"2026-08-07T00:41:48.421514Z","title":"analysis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:48.421514Z"},"links":{"cited_paper":"/paper/2406.18532","citing_paper":"/paper/2506.12928"},"observation_digest":"sha256:518f7121667310baace5de6a044294da19eba880fde768750f4e7580e4f3eda2","observation_id":"752036d6-2d75-4ae0-8470-afc36563930b","resolution":{"observed_at":"2026-08-07T00:41:48.421514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.12928","last_updated":"2025-06-15T17:59:47Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-09T00:02:34.658764Z","submitted_at":"2025-06-15T17:59:47Z","title":"Scaling Test-time Compute for LLM Agents"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":29,"verified_exact":0,"verified_fuzzy":3},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 16 inbound Pith citation observations for arXiv:2506.12928."}