{"as_of":"2026-08-14T01:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ad49947a78a1d8e8394343a0182c2c9ec40347a4209820853305425ad800972d","coverage":[{"denominator":63,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":63,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:40:59.083259Z","state":"measured"},{"denominator":80,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":80,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":17,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T21:34:45.225752Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T20:40:08.275113Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01716","snapshot_observed_at":"2026-08-06T21:34:45.225752Z","title":"Self-challenging language model agents,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23844","last_updated":"2025-06-30T13:34:34Z","snapshot_observed_at":"2026-08-14T01:01:55.822518Z","submitted_at":"2025-06-30T13:34:34Z","title":"A Survey on Autonomy-Induced Security Risks in Large Model-Based Agents","version":1},"reference_index":162,"source":"pdf_text","source_observed_at":"2026-08-06T21:34:45.225752Z"},"links":{"cited_paper":"/paper/2506.01716","citing_paper":"/paper/2506.23844"},"observation_digest":"sha256:7c19580d5731582c6ef41735f0392b8d621ab7bd6d12479db130e8c09c8737f1","observation_id":"8c8e5dff-a1bb-4d5b-9570-67e5ef85cc2b","resolution":{"observed_at":"2026-08-06T21:34:45.225752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01716","snapshot_observed_at":"2026-08-06T21:10:06.741227Z","title":"Self-challenging language model agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00829","last_updated":"2025-07-01T15:01:18Z","snapshot_observed_at":"2026-08-08T03:47:45.535102Z","submitted_at":"2025-07-01T15:01:18Z","title":"On the Surprising Efficacy of LLMs for Penetration-Testing","version":1},"reference_index":123,"source":"pdf_text","source_observed_at":"2026-08-06T21:10:06.741227Z"},"links":{"cited_paper":"/paper/2506.01716","citing_paper":"/paper/2507.00829"},"observation_digest":"sha256:cf209dcc2d9b6e024db37f14e91c004bed72ea92671524cab7e0194f532f87f0","observation_id":"a9b936a2-fdb3-4a97-83f4-d8fb2ad1bedd","resolution":{"observed_at":"2026-08-06T21:10:06.741227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01716","snapshot_observed_at":"2026-08-05T21:01:24.837854Z","title":"Marine Micro Bot - 5v2 Marines vs Zealots!","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2508.09586","last_updated":"2025-08-20T07:50:49Z","snapshot_observed_at":"2026-08-07T12:33:53.736485Z","submitted_at":"2025-08-13T07:59:29Z","title":"EvoCurr: Self-evolving Curriculum with Behavior Code Generation for Complex Decision-making","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-05T21:01:24.837854Z"},"links":{"cited_paper":"/paper/2506.01716","citing_paper":"/paper/2508.09586"},"observation_digest":"sha256:ab3eb867c27902e3a6880d97e07fc3458daf908f556187b6ddc3bf8dae35dbbc","observation_id":"44909370-f083-47e1-ba86-69cc313916ef","resolution":{"observed_at":"2026-08-05T21:01:24.837854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01716","snapshot_observed_at":"2026-08-04T11:34:15.689366Z","title":"doi:10.48550/arXiv.2506.01716","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.04033","last_updated":"2026-06-22T22:02:33Z","snapshot_observed_at":"2026-08-13T12:47:04.185539Z","submitted_at":"2025-10-05T04:52:26Z","title":"A global log for medical AI","version":2},"reference_index":124,"source":"pdf_text","source_observed_at":"2026-08-04T11:34:15.689366Z"},"links":{"cited_paper":"/paper/2506.01716","citing_paper":"/paper/2510.04033"},"observation_digest":"sha256:2150df4535d81d43a8e8f0e44e03eb9e529e29a9537db1d34ba8d5d1b25fccce","observation_id":"0919db2c-5c8f-4623-b730-30bdc51d60f7","resolution":{"observed_at":"2026-08-04T11:34:15.689366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01716","snapshot_observed_at":"2026-08-04T10:48:06.257869Z","title":"Self-challenging language model agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.08558","last_updated":"2026-05-24T21:56:11Z","snapshot_observed_at":"2026-08-04T10:47:54.049813Z","submitted_at":"2025-10-09T17:59:17Z","title":"Agent Learning via Early Experience","version":3},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-04T10:48:06.257869Z"},"links":{"cited_paper":"/paper/2506.01716","citing_paper":"/paper/2510.08558"},"observation_digest":"sha256:178500e296d28420a492961998f2be0a50989cb9a8db11589142f2e49b0ee09b","observation_id":"76755336-f839-4dc1-9ff6-32b58057e22b","resolution":{"observed_at":"2026-08-04T10:48:06.257869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"cited_work":{"arxiv_id":"2506.01716","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01716","snapshot_observed_at":"2026-07-04T20:40:08.275113Z","title":"arXiv:2506.01716 [cs] doi:10","venue":null,"work_id":"f17aef0d-21ef-4877-b0a2-e7492e1d481f","year":2025},"citing_paper":{"arxiv_id":"2604.09579","last_updated":"2026-02-25T07:46:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-02-25T07:46:39Z","title":"Help Without Being Asked: A Deployed Proactive Agent System for On-Call Support with Continuous Self-Improvement","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-15T19:55:48.665958Z"},"links":{"cited_paper":"/paper/2506.01716","citing_paper":"/paper/2604.09579"},"observation_digest":"sha256:ff39741c576fcad51daaf948836a828babd7ae52161fe34a6b5731c112eb67ef","observation_id":"2b82e5b8-1b53-460d-a017-6896d798bfd9","resolution":{"observed_at":"2026-05-15T19:56:33.422593Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"cited_work":{"arxiv_id":"2506.01716","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01716","snapshot_observed_at":"2026-07-04T20:40:08.275113Z","title":"arXiv:2506.01716 [cs] doi:10","venue":null,"work_id":"f17aef0d-21ef-4877-b0a2-e7492e1d481f","year":2025},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"cited_paper":"/paper/2506.01716","citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:3115a1e5c887e435590a0b01eed28dcfb4da1feef697517271790ea8bb16f740","observation_id":"c40d748a-1a6a-45f1-b923-dca4511200a7","resolution":{"observed_at":"2026-05-10T12:10:23.528665Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"cited_work":{"arxiv_id":"2506.01716","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01716","snapshot_observed_at":"2026-07-04T20:40:08.275113Z","title":"arXiv:2506.01716 [cs] doi:10","venue":null,"work_id":"f17aef0d-21ef-4877-b0a2-e7492e1d481f","year":2025},"citing_paper":{"arxiv_id":"2604.20051","last_updated":"2026-05-07T16:30:21Z","snapshot_observed_at":"2026-08-11T07:05:08.289927Z","submitted_at":"2026-04-21T23:21:56Z","title":"Bootstrapping Post-training Signals for Open-ended Tasks via Rubric-based Self-play on Pre-training Text","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-10T01:51:00.913166Z"},"links":{"cited_paper":"/paper/2506.01716","citing_paper":"/paper/2604.20051"},"observation_digest":"sha256:64ac343b286c2a9d9fac871b98e633150a4d7368474b2a81d02cfca779dae112","observation_id":"ec11e069-6aa6-4de0-9353-d988fd8028ef","resolution":{"observed_at":"2026-05-11T13:21:15.160379Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"cited_work":{"arxiv_id":"2506.01716","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01716","snapshot_observed_at":"2026-07-04T20:40:08.275113Z","title":"arXiv:2506.01716 [cs] doi:10","venue":null,"work_id":"f17aef0d-21ef-4877-b0a2-e7492e1d481f","year":2025},"citing_paper":{"arxiv_id":"2605.09959","last_updated":"2026-05-11T04:12:34Z","snapshot_observed_at":"2026-08-11T16:16:11.008726Z","submitted_at":"2026-05-11T04:12:34Z","title":"G-Zero: Self-Play for Open-Ended Generation from Zero Data","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-12T03:39:40.780801Z"},"links":{"cited_paper":"/paper/2506.01716","citing_paper":"/paper/2605.09959"},"observation_digest":"sha256:6fad194cad8cf3968d449b7efcefdaa06f0b0cbde243fcacf0c41fb20cf28782","observation_id":"d6a93fdf-ad16-42ef-be51-5363fbcb7baa","resolution":{"observed_at":"2026-05-12T07:11:24.540151Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"cited_work":{"arxiv_id":"2506.01716","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01716","snapshot_observed_at":"2026-07-04T20:40:08.275113Z","title":"arXiv:2506.01716 [cs] doi:10","venue":null,"work_id":"f17aef0d-21ef-4877-b0a2-e7492e1d481f","year":2025},"citing_paper":{"arxiv_id":"2605.29115","last_updated":"2026-05-27T21:23:00Z","snapshot_observed_at":"2026-08-01T21:39:08.620495Z","submitted_at":"2026-05-27T21:23:00Z","title":"unix-ctf: Procedural Environments for Unix-Competence Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-29T11:19:38.959705Z"},"links":{"cited_paper":"/paper/2506.01716","citing_paper":"/paper/2605.29115"},"observation_digest":"sha256:136a7d0ba61558005ed393a0ff6070358c076dd904f75e43a3ec841e671aed36","observation_id":"bc6d68ac-dd6b-428c-8fd6-2d9f97ce6bfc","resolution":{"observed_at":"2026-06-29T11:23:20.889344Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"cited_work":{"arxiv_id":"2506.01716","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01716","snapshot_observed_at":"2026-07-04T20:40:08.275113Z","title":"arXiv:2506.01716 [cs] doi:10","venue":null,"work_id":"f17aef0d-21ef-4877-b0a2-e7492e1d481f","year":2025},"citing_paper":{"arxiv_id":"2606.01286","last_updated":"2026-05-31T15:12:16Z","snapshot_observed_at":"2026-08-03T00:41:34.020605Z","submitted_at":"2026-05-31T15:12:16Z","title":"BenchEvolver: Frontier Task Synthesis via Solution-Centric Evolution","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-28T16:49:50.653594Z"},"links":{"cited_paper":"/paper/2506.01716","citing_paper":"/paper/2606.01286"},"observation_digest":"sha256:8e1a7caa3a015baa03a207fd77e2f7a673357f135af2928e367e1662bd06ab8c","observation_id":"75264551-f090-40b5-8889-1034574942d0","resolution":{"observed_at":"2026-07-01T21:36:14.692118Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"cited_work":{"arxiv_id":"2506.01716","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01716","snapshot_observed_at":"2026-07-04T20:40:08.275113Z","title":"arXiv:2506.01716 [cs] doi:10","venue":null,"work_id":"f17aef0d-21ef-4877-b0a2-e7492e1d481f","year":2025},"citing_paper":{"arxiv_id":"2606.12908","last_updated":"2026-06-11T05:06:50Z","snapshot_observed_at":"2026-08-12T14:52:30.848387Z","submitted_at":"2026-06-11T05:06:50Z","title":"SENTINEL: Failure-Driven Reinforcement Learning for Training Tool-Using Language Model Agents","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-06-27T06:49:12.070481Z"},"links":{"cited_paper":"/paper/2506.01716","citing_paper":"/paper/2606.12908"},"observation_digest":"sha256:12f592fcd84f3b6f6249119eb251d55a05cce8c71330a8c9de3d0b4302815ff4","observation_id":"bbab49ce-fdad-41c3-8d4e-f97b020e41b5","resolution":{"observed_at":"2026-07-03T14:58:33.158166Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"cited_work":{"arxiv_id":"2506.01716","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01716","snapshot_observed_at":"2026-07-04T20:40:08.275113Z","title":"arXiv:2506.01716 [cs] doi:10","venue":null,"work_id":"f17aef0d-21ef-4877-b0a2-e7492e1d481f","year":2025},"citing_paper":{"arxiv_id":"2606.20913","last_updated":"2026-06-18T20:09:13Z","snapshot_observed_at":"2026-08-13T04:58:12.828049Z","submitted_at":"2026-06-18T20:09:13Z","title":"PROTON: Prototype-Based Test-Time Online OOD Detection for Medical VLMs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-26T17:46:19.654341Z"},"links":{"cited_paper":"/paper/2506.01716","citing_paper":"/paper/2606.20913"},"observation_digest":"sha256:f6dcce48407aa2c09a25ff3135995314d4a4fb1193fb088f00e5da0b2bd10f92","observation_id":"690af5de-7de2-4896-8668-b5dddf254573","resolution":{"observed_at":"2026-07-04T03:39:30.510413Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"cited_work":{"arxiv_id":"2506.01716","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01716","snapshot_observed_at":"2026-07-04T20:40:08.275113Z","title":"arXiv:2506.01716 [cs] doi:10","venue":null,"work_id":"f17aef0d-21ef-4877-b0a2-e7492e1d481f","year":2025},"citing_paper":{"arxiv_id":"2606.25996","last_updated":"2026-07-04T15:07:51Z","snapshot_observed_at":"2026-08-07T11:35:11.679286Z","submitted_at":"2026-06-24T16:08:31Z","title":"Autodata: An agentic data scientist to create high quality synthetic data","version":1},"reference_index":125,"source":"arxiv_source","source_observed_at":"2026-06-25T19:50:35.574454Z"},"links":{"cited_paper":"/paper/2506.01716","citing_paper":"/paper/2606.25996"},"observation_digest":"sha256:a8ae28f6daf5fa58183b68a0ca18ed0275515e754bdfa8d4e74ba751ac9efb33","observation_id":"b43cfd81-e61e-4f3d-b85d-9e7af405a657","resolution":{"observed_at":"2026-07-04T20:40:08.276542Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"cited_work":{"arxiv_id":"2506.01716","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01716","snapshot_observed_at":"2026-07-04T20:40:08.275113Z","title":"arXiv:2506.01716 [cs] doi:10","venue":null,"work_id":"f17aef0d-21ef-4877-b0a2-e7492e1d481f","year":2025},"citing_paper":{"arxiv_id":"2606.25996","last_updated":"2026-07-04T15:07:51Z","snapshot_observed_at":"2026-08-07T11:35:11.679286Z","submitted_at":"2026-06-24T16:08:31Z","title":"Autodata: An agentic data scientist to create high quality synthetic data","version":2},"reference_index":125,"source":"arxiv_source","source_observed_at":"2026-06-26T05:16:12.361470Z"},"links":{"cited_paper":"/paper/2506.01716","citing_paper":"/paper/2606.25996"},"observation_digest":"sha256:1b90e876136f3d18ab221aa793a88cbc14ddfefea658d70fafbd3c8b967eb4e7","observation_id":"63012396-d1c7-464f-ba22-ff404ea41de7","resolution":{"observed_at":"2026-07-04T13:19:51.230606Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01716","snapshot_observed_at":"2026-07-12T12:08:06.206832Z","title":"Self-challenging language model agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.25996","last_updated":"2026-07-04T15:07:51Z","snapshot_observed_at":"2026-08-07T11:35:11.679286Z","submitted_at":"2026-06-24T16:08:31Z","title":"Autodata: An agentic data scientist to create high quality synthetic data","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-07-12T12:08:06.206832Z"},"links":{"cited_paper":"/paper/2506.01716","citing_paper":"/paper/2606.25996"},"observation_digest":"sha256:2b1cc0b353668f3ef60bd58e89cc99592de61c700398b9873fcad8d33904f1a0","observation_id":"876aefd1-24ed-4b36-9741-cf7d9a18fa55","resolution":{"observed_at":"2026-07-12T12:08:06.206832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"cited_work":{"arxiv_id":"2506.01716","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01716","snapshot_observed_at":"2026-07-04T20:40:08.275113Z","title":"arXiv:2506.01716 [cs] doi:10","venue":null,"work_id":"f17aef0d-21ef-4877-b0a2-e7492e1d481f","year":2025},"citing_paper":{"arxiv_id":"2606.27483","last_updated":"2026-06-25T19:05:44Z","snapshot_observed_at":"2026-08-01T16:32:32.633211Z","submitted_at":"2026-06-25T19:05:44Z","title":"Internalizing the Future: A Unified Agentic Training Paradigm for World Model Planning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-29T01:53:56.067792Z"},"links":{"cited_paper":"/paper/2506.01716","citing_paper":"/paper/2606.27483"},"observation_digest":"sha256:1e46a007ac118d56ebd68379895ad06fbe994b128077b9b77c7b9560300a317e","observation_id":"27bf22bf-c004-4295-b46e-018c7c847b7b","resolution":{"observed_at":"2026-07-01T18:35:58.476165Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.01716/citation-record","integrity":"/paper/2506.01716/integrity","json":"/paper/2506.01716/citation-record.json","paper":"/paper/2506.01716"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:41:11.962510Z","title":"Digirl: Training in-the-wild device-control agents with autonomous reinforcement learning,","venue":null,"work_id":"27bf97a1-c222-4f6e-9160-97d1a1db3791","year":null},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:11.165262Z"},"links":{"citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:22d5566782283043beefb65dd1867a3f5e16cd53cfca7a7b9bcb133d3c5c6672","observation_id":"44438846-9183-4610-90f0-7e593061c643","resolution":{"observed_at":"2026-08-07T11:41:12.244449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:41:11.511487Z","title":"Digi-q: Learning q-value functions for training device-control agents, 2025","venue":null,"work_id":"264fe87d-04f0-43da-89a1-3123598b5b42","year":2025},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:11.807116Z"},"links":{"citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:3c9d0a369ac5b6a1b2e418e87cb62cfa26edfab456f145c3ecf435844eab9c84","observation_id":"4fcd1709-dd65-44fe-9aaf-d2c5432967d9","resolution":{"observed_at":"2026-08-07T11:41:11.710204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:41:11.080441Z","title":"Active learning of inverse models with intrinsically motivated goal exploration in robots.Robotics and Autonomous Systems, 61(1):49–73, January","venue":null,"work_id":"cb96e199-fa49-4b1c-b6dc-6957de43493e","year":null},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:11.882735Z"},"links":{"citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:c57bb235a0af76a50b8fbde44afc40840733f43446e54d388f4e84fa83ecbe32","observation_id":"bbfc647f-825b-4944-83b2-87e8202bbfb5","resolution":{"observed_at":"2026-08-07T11:41:11.280110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01335","last_updated":"2024-06-14T21:17:17Z","snapshot_observed_at":"2026-08-13T19:59:28.723365Z","submitted_at":"2024-01-02T18:53:13Z","title":"Self-Play Fine-Tuning Converts Weak Language Models to Strong Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.01335","snapshot_observed_at":"2026-08-07T11:40:11.978479Z","title":"Self-play fine-tuning converts weak language models to strong language models.arXiv preprint arXiv:2401.01335, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:11.978479Z"},"links":{"cited_paper":"/paper/2401.01335","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:588e2093277b82b21d480aa888dac2b686fb2ceffc2302a6fc5c211bd02dca80","observation_id":"46d9604d-cec9-4ee1-a125-379e12100f72","resolution":{"observed_at":"2026-08-07T11:40:11.978479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.12487","last_updated":"2023-05-21T15:42:41Z","snapshot_observed_at":"2026-08-13T11:37:53.324858Z","submitted_at":"2023-05-21T15:42:41Z","title":"Augmenting Autotelic Agents with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.12487","snapshot_observed_at":"2026-08-07T11:40:11.995004Z","title":"Augmenting autotelic agents with large language models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:11.995004Z"},"links":{"cited_paper":"/paper/2305.12487","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:52d086bdfa4eb085a3765c02f1c969a04946c0299b1ce60a7cd0ce5319b22e42","observation_id":"55271e5d-fbaa-47c6-af00-754928eef049","resolution":{"observed_at":"2026-08-07T11:40:11.995004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00212","last_updated":"2025-03-21T03:27:55Z","snapshot_observed_at":"2026-08-09T19:44:34.143549Z","submitted_at":"2025-01-31T23:01:48Z","title":"STP: Self-play LLM Theorem Provers with Iterative Conjecturing and Proving","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00212","snapshot_observed_at":"2026-08-07T11:40:12.012166Z","title":"Stp: Self-play llm theorem provers with iterative conjecturing and proving, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:12.012166Z"},"links":{"cited_paper":"/paper/2502.00212","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:00f1459595cb9f2d6e1da6c111cdaf6291b70aafbc1f817cff87f5f68e0490ec","observation_id":"3e308654-6358-4618-b627-6424c6b70c04","resolution":{"observed_at":"2026-08-07T11:40:12.012166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15568","last_updated":"2025-02-14T14:24:59Z","snapshot_observed_at":"2026-08-12T23:58:47.608264Z","submitted_at":"2024-05-24T13:57:32Z","title":"OMNI-EPIC: Open-endedness via Models of human Notions of Interestingness with Environments Programmed in Code","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.15568","snapshot_observed_at":"2026-08-07T11:40:12.036961Z","title":"Omni-epic: Open-endedness via models of human notions of interestingness with environments programmed in code, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:12.036961Z"},"links":{"cited_paper":"/paper/2405.15568","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:8d71028c5ddb0a537b6c942c07d9de66f4762b1f6b2fe45d40c6693123864128","observation_id":"e2e57cc7-d1e9-4b17-8f2a-79768333aacb","resolution":{"observed_at":"2026-08-07T11:40:12.036961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07714","last_updated":"2025-03-05T07:39:03Z","snapshot_observed_at":"2026-08-13T04:59:08.554752Z","submitted_at":"2024-03-12T14:57:40Z","title":"StableToolBench: Towards Stable Large-Scale Benchmarking on Tool Learning of Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07714","snapshot_observed_at":"2026-08-07T11:40:12.061630Z","title":"Stabletoolbench: Towards stable large-scale benchmarking on tool learning of large language models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:12.061630Z"},"links":{"cited_paper":"/paper/2403.07714","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:af67d6d8427481fd1983af3e41fc4d5b795a1a9bcb097530bfacdf828f14814e","observation_id":"84c72a2d-a0d9-4de3-813c-6a0277e8d042","resolution":{"observed_at":"2026-08-07T11:40:12.061630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13919","last_updated":"2024-06-06T18:37:34Z","snapshot_observed_at":"2026-08-09T21:47:22.232349Z","submitted_at":"2024-01-25T03:33:18Z","title":"WebVoyager: Building an End-to-End Web Agent with Large Multimodal Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13919","snapshot_observed_at":"2026-08-07T11:40:12.096694Z","title":"Webvoyager: Building an end-to-end web agent with large multimodal models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:12.096694Z"},"links":{"cited_paper":"/paper/2401.13919","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:4a25b9b8b2789330f4bd7aae9f8e4b295f3c7bb55e651f3dd000653e4f044185","observation_id":"4140923c-5a01-4a12-8a70-8c059f3d40e8","resolution":{"observed_at":"2026-08-07T11:40:12.096694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.19609","last_updated":"2024-10-25T15:01:27Z","snapshot_observed_at":"2026-08-12T22:15:04.474747Z","submitted_at":"2024-10-25T15:01:27Z","title":"OpenWebVoyager: Building Multimodal Web Agents via Iterative Real-World Exploration, Feedback and Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.19609","snapshot_observed_at":"2026-08-07T11:40:12.120277Z","title":"Openwebvoyager: Building multimodal web agents via iterative real-world exploration, feedback and optimization, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:12.120277Z"},"links":{"cited_paper":"/paper/2410.19609","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:b0ebe7e7865d508b423c3f4ac6fc79841a5fe9d237341ae099a7f3d1c50a2382","observation_id":"55458e07-f4f4-41b1-98ed-6a97190d5b90","resolution":{"observed_at":"2026-08-07T11:40:12.120277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00764","last_updated":"2025-02-06T09:17:39Z","snapshot_observed_at":"2026-08-12T23:10:01.915117Z","submitted_at":"2024-08-01T17:59:46Z","title":"AgentGen: Enhancing Planning Abilities for Large Language Model based Agent via Environment and Task Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00764","snapshot_observed_at":"2026-08-07T11:40:12.166978Z","title":"Agentgen: Enhancing planning abilities for large language model based agent via environment and task generation, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:12.166978Z"},"links":{"cited_paper":"/paper/2408.00764","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:e3ee6265b39c0a88bc8505c61ced895977b10223f3cb3150b7e3b68d21b1af1e","observation_id":"7075c19d-3928-4696-92d9-216f700d1d63","resolution":{"observed_at":"2026-08-07T11:40:12.166978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.07207","last_updated":"2022-03-08T06:47:17Z","snapshot_observed_at":"2026-08-06T08:07:23.771593Z","submitted_at":"2022-01-18T18:59:45Z","title":"Language Models as Zero-Shot Planners: Extracting Actionable Knowledge for Embodied Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.07207","snapshot_observed_at":"2026-08-07T11:40:12.226948Z","title":"Language models as zero-shot planners: Extracting actionable knowledge for embodied agents, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:12.226948Z"},"links":{"cited_paper":"/paper/2201.07207","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:476060af7928e531c841f4bbd4deabcfe6dbbc6a6b5704804fa6e760860f3af6","observation_id":"e5012d17-4c79-439e-902d-1f3c5defdb41","resolution":{"observed_at":"2026-08-07T11:40:12.226948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.05973","last_updated":"2023-11-02T06:53:37Z","snapshot_observed_at":"2026-08-05T01:03:23.456778Z","submitted_at":"2023-07-12T07:40:48Z","title":"VoxPoser: Composable 3D Value Maps for Robotic Manipulation with Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.05973","snapshot_observed_at":"2026-08-07T11:40:12.312709Z","title":"V oxposer: Composable 3d value maps for robotic manipulation with language models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:12.312709Z"},"links":{"cited_paper":"/paper/2307.05973","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:2ede16f79229596762308b9a7d3d684f403e4b0c156355f86c426349f089b2dd","observation_id":"410f2c01-01f4-4f77-a7ff-0e1c58e280a3","resolution":{"observed_at":"2026-08-07T11:40:12.312709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06770","last_updated":"2024-11-11T23:05:04Z","snapshot_observed_at":"2026-08-12T14:56:35.025839Z","submitted_at":"2023-10-10T16:47:29Z","title":"SWE-bench: Can Language Models Resolve Real-World GitHub Issues?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06770","snapshot_observed_at":"2026-08-07T11:40:23.082871Z","title":"Jimenez, John Yang, Alexander Wettig, Shunyu Yao, Kexin Pei, Ofir Press, and Karthik Narasimhan","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:23.082871Z"},"links":{"cited_paper":"/paper/2310.06770","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:75b989c50c8f8c68efde180be84c4142470ef4c71b212f212a5b3ab16eb29ca2","observation_id":"f0edaf56-ac88-469d-ab56-cbf610a6870a","resolution":{"observed_at":"2026-08-07T11:40:23.082871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.07753","last_updated":"2023-05-25T03:50:11Z","snapshot_observed_at":"2026-08-05T02:35:14.331933Z","submitted_at":"2022-09-16T07:17:23Z","title":"Code as Policies: Language Model Programs for Embodied Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.07753","snapshot_observed_at":"2026-08-07T11:40:23.397800Z","title":"Code as policies: Language model programs for embodied control, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:23.397800Z"},"links":{"cited_paper":"/paper/2209.07753","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:ce8f21e5fc0fbf233774044b602e39f3ac15dd0212294469157fe1c3282e6466","observation_id":"b43d03bc-307d-44df-902d-a0d13e9eb2c3","resolution":{"observed_at":"2026-08-07T11:40:23.397800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03688","last_updated":"2025-10-04T03:54:18Z","snapshot_observed_at":"2026-08-13T14:09:17.964744Z","submitted_at":"2023-08-07T16:08:11Z","title":"AgentBench: Evaluating LLMs as Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03688","snapshot_observed_at":"2026-08-07T11:40:23.658612Z","title":"Agentbench: Evaluating llms as agents, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:23.658612Z"},"links":{"cited_paper":"/paper/2308.03688","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:999ef263b96023a05be8d980a4c5a082caf22691f8f2b3615508db11a23ea6cd","observation_id":"ab90699e-f496-42b9-bff5-e614f6818198","resolution":{"observed_at":"2026-08-07T11:40:23.658612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:41:10.679685Z","title":"Toolverifier: Generalization to new tools via self-verification,","venue":null,"work_id":"7ca64bda-ad90-45c1-b055-109b1acdb848","year":null},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:24.131209Z"},"links":{"citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:9c32c528a216f21942c54634ec93a55e3e3d0fe6bc98b4ba814396b305236321","observation_id":"8efe4362-c272-49f6-b02d-572875a7f6a5","resolution":{"observed_at":"2026-08-07T11:41:10.860546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08140","last_updated":"2024-06-09T01:12:26Z","snapshot_observed_at":"2026-08-13T00:55:37.511798Z","submitted_at":"2024-03-12T23:59:15Z","title":"BAGEL: Bootstrapping Agents by Guiding Exploration with Language","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08140","snapshot_observed_at":"2026-08-07T11:40:32.879610Z","title":"Bagel: Bootstrapping agents by guiding exploration with language, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:32.879610Z"},"links":{"cited_paper":"/paper/2403.08140","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:78b0070be30aeae40ca0a3525dae22b36e9788df3d28745466eb2de5d8503c18","observation_id":"8509d31a-19ea-4514-b398-4b1ab50c565b","resolution":{"observed_at":"2026-08-07T11:40:32.879610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02907","last_updated":"2025-02-05T18:56:51Z","snapshot_observed_at":"2026-08-12T22:31:19.020948Z","submitted_at":"2024-10-03T18:56:51Z","title":"NNetNav: Unsupervised Learning of Browser Agents Through Environment Interaction in the Wild","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02907","snapshot_observed_at":"2026-08-07T11:40:34.931028Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:34.931028Z"},"links":{"cited_paper":"/paper/2410.02907","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:10931453fef5a886416ec5beb1b4cdeb52b5b4b4f16af1f0ba3a4069cd41153e","observation_id":"35fe6451-5425-4df8-8a1d-3c4c4b110d75","resolution":{"observed_at":"2026-08-07T11:40:34.931028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14158","last_updated":"2024-03-13T16:38:42Z","snapshot_observed_at":"2026-08-13T04:13:20.379510Z","submitted_at":"2024-02-21T22:41:38Z","title":"TOOLVERIFIER: Generalization to New Tools via Self-Verification","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14158","snapshot_observed_at":"2026-08-07T11:40:31.436426Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:31.436426Z"},"links":{"cited_paper":"/paper/2402.14158","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:9215bd85365fc7c216a103962c13c14f05688fb5b02ad8abcb93adfcc910b243","observation_id":"069c1569-803a-4f1a-985f-f97a6115f015","resolution":{"observed_at":"2026-08-07T11:40:31.436426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.04882","last_updated":"2021-01-13T05:20:20Z","snapshot_observed_at":"2026-08-13T20:31:14.088057Z","submitted_at":"2021-01-13T05:20:20Z","title":"Asymmetric self-play for automatic goal discovery in robotic manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.04882","snapshot_observed_at":"2026-08-07T11:40:35.884878Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:35.884878Z"},"links":{"cited_paper":"/paper/2101.04882","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:333c36af293c7af51e2fcce040e217fda494f89c0cf9db926c61e4b313383457","observation_id":"a7a30c5e-1ac8-484e-8257-9319e44a419a","resolution":{"observed_at":"2026-08-07T11:40:35.884878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21139","last_updated":"2025-06-06T07:53:20Z","snapshot_observed_at":"2026-07-06T20:14:49.976782Z","submitted_at":"2024-12-30T18:15:39Z","title":"Training Software Engineering Agents and Verifiers with SWE-Gym","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.21139","snapshot_observed_at":"2026-08-07T11:40:35.947084Z","title":"Training software engineering agents and verifiers with swe-gym, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:35.947084Z"},"links":{"cited_paper":"/paper/2412.21139","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:c28373577f8b1112ec6236569dba662f2f89e1f7fdaf300304402f956c2f1e7e","observation_id":"dbc14c05-cbd6-4278-9d8e-95b3dd20e67a","resolution":{"observed_at":"2026-08-07T11:40:35.947084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T11:40:35.724518Z","title":"Gpt-4 technical report, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:35.724518Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:fd48b42d7e7d8476e2106e8880705c58508ebb4801774965b4df111c06e968b1","observation_id":"2e72e425-b329-461c-9199-90b445ef3a6c","resolution":{"observed_at":"2026-08-07T11:40:35.724518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02337","last_updated":"2025-01-27T11:56:15Z","snapshot_observed_at":"2026-08-12T22:08:01.336040Z","submitted_at":"2024-11-04T17:59:58Z","title":"WebRL: Training LLM Web Agents via Self-Evolving Online Curriculum Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02337","snapshot_observed_at":"2026-08-07T11:40:36.060344Z","title":"Webrl: Training llm web agents via self-evolving online curriculum reinforcement learning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:36.060344Z"},"links":{"cited_paper":"/paper/2411.02337","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:1a1cdc35981a1a28e7c0884ce1f3710a3bb09fe085b12d9f36346f198cf31eaa","observation_id":"dcba1132-d734-494e-be0a-fc5a787f1ed5","resolution":{"observed_at":"2026-08-07T11:40:36.060344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.16789","last_updated":"2023-10-03T14:45:48Z","snapshot_observed_at":"2026-07-06T16:00:46.542753Z","submitted_at":"2023-07-31T15:56:53Z","title":"ToolLLM: Facilitating Large Language Models to Master 16000+ Real-world APIs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.16789","snapshot_observed_at":"2026-08-07T11:40:45.358026Z","title":"Toolllm: Facilitating large language models to master 16000+ real-world apis, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:45.358026Z"},"links":{"cited_paper":"/paper/2307.16789","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:74cead897d5858db36cf4f0a1b89a30fd173c61bece042484027a092f566d436","observation_id":"bd9b4def-ad0f-4d5b-a55b-888658788f96","resolution":{"observed_at":"2026-08-07T11:40:45.358026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06474","last_updated":"2024-10-07T14:19:37Z","snapshot_observed_at":"2026-08-13T00:34:00.295715Z","submitted_at":"2024-04-09T17:25:47Z","title":"Autonomous Evaluation and Refinement of Digital Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.06474","snapshot_observed_at":"2026-08-07T11:40:36.023988Z","title":"Au- tonomous evaluation and refinement of digital agents, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:36.023988Z"},"links":{"cited_paper":"/paper/2404.06474","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:22f2064238bcee90d0787f1db7a2ae0ad9d8485d0f7227327e8f806ba16199a4","observation_id":"6dc74701-3f40-4066-a660-f5562c4d9d39","resolution":{"observed_at":"2026-08-07T11:40:36.023988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.04761","last_updated":"2023-02-09T16:49:57Z","snapshot_observed_at":"2026-07-06T14:50:07.491434Z","submitted_at":"2023-02-09T16:49:57Z","title":"Toolformer: Language Models Can Teach Themselves to Use Tools","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.04761","snapshot_observed_at":"2026-08-07T11:40:55.541784Z","title":"Toolformer: Language models can teach themselves to use tools, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:55.541784Z"},"links":{"cited_paper":"/paper/2302.04761","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:8942b6f550b7b890629209f4d030d28a6a37be5555655918a1856a1b32f1447e","observation_id":"28c6de98-65d2-48c1-919e-d9871dddb61f","resolution":{"observed_at":"2026-08-07T11:40:55.541784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T11:40:55.869742Z","title":"Proximal policy optimization algorithms, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:55.869742Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:7fe3cb743d78b681fe38ba14066ecf09dbc36cd593deb5bb3570b363e9ceea81","observation_id":"423fe5aa-3fd5-4986-aa7a-15cc66178918","resolution":{"observed_at":"2026-08-07T11:40:55.869742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:40:53.228339Z","title":"Manning, and Chelsea Finn","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:53.228339Z"},"links":{"citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:6329913907893c6eb03e27a5ad97cbdddd1724f95115b86fb130bea9a1697ccf","observation_id":"89d3f2f5-b7e7-477f-a571-cb0b6ec08b64","resolution":{"observed_at":"2026-08-07T11:40:53.228339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18290","last_updated":"2024-07-29T22:26:36Z","snapshot_observed_at":"2026-08-01T16:34:38.795326Z","submitted_at":"2023-05-29T17:57:46Z","title":"Direct Preference Optimization: Your Language Model is Secretly a Reward Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18290","snapshot_observed_at":"2026-08-07T11:40:54.882578Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:54.882578Z"},"links":{"cited_paper":"/paper/2305.18290","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:017350f58c183a2bd009a20438288ab5dfc55ddc67aeb6c1b859dbd58eef8242","observation_id":"9d9150a1-90bd-4f29-a1de-30872947537f","resolution":{"observed_at":"2026-08-07T11:40:54.882578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.16464","last_updated":"2025-06-16T22:23:37Z","snapshot_observed_at":"2026-08-13T17:57:54.353310Z","submitted_at":"2024-10-21T19:46:06Z","title":"Beyond Browsing: API-Based Web Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.16464","snapshot_observed_at":"2026-08-07T11:40:55.995454Z","title":"Beyond browsing: Api-based web agents, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:55.995454Z"},"links":{"cited_paper":"/paper/2410.16464","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:e3c8e60cf8dc564171eba445a9e3dc053f768f62e85ae090d036c1b67ad380f5","observation_id":"f77b4a4f-c468-4e2b-a958-4a503f82f586","resolution":{"observed_at":"2026-08-07T11:40:55.995454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.10893","last_updated":"2025-01-18T22:34:41Z","snapshot_observed_at":"2026-08-10T22:27:08.878421Z","submitted_at":"2025-01-18T22:34:41Z","title":"Learn-by-interact: A Data-Centric Framework for Self-Adaptive Agents in Realistic Environments","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.10893","snapshot_observed_at":"2026-08-07T11:40:56.046550Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:56.046550Z"},"links":{"cited_paper":"/paper/2501.10893","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:a6b3ea746fab6e141ecf403433c9dc609d2818a7f7106e5e95fca7230aea8964","observation_id":"ba78255a-5eb4-47a1-95e4-33852fa53471","resolution":{"observed_at":"2026-08-07T11:40:56.046550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T11:40:55.914021Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:55.914021Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:eaca3de2b0be3910f1fbfcd9f351ed1a31cf0db358ed85877d47bf04fbba40e2","observation_id":"0dfb5f3c-33f7-400d-935a-6330fb4c0154","resolution":{"observed_at":"2026-08-07T11:40:55.914021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16533","last_updated":"2025-03-04T11:33:50Z","snapshot_observed_at":"2026-08-12T23:57:48.206647Z","submitted_at":"2024-05-26T11:40:58Z","title":"Tool Learning in the Wild: Empowering Language Models as Automatic Tool Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16533","snapshot_observed_at":"2026-08-07T11:40:55.929577Z","title":"Tool learning in the wild: Empowering language models as automatic tool agents, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:55.929577Z"},"links":{"cited_paper":"/paper/2405.16533","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:7e738d9c380d9a3c8c2c35d455b937c40dc190221a509d92aacba211e25508dc","observation_id":"1bbadf7a-eb55-403f-ade2-fb13aff91af2","resolution":{"observed_at":"2026-08-07T11:40:55.929577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.18901","last_updated":"2024-07-26T17:55:45Z","snapshot_observed_at":"2026-08-12T23:13:58.709084Z","submitted_at":"2024-07-26T17:55:45Z","title":"AppWorld: A Controllable World of Apps and People for Benchmarking Interactive Coding Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.18901","snapshot_observed_at":"2026-08-07T11:40:57.755014Z","title":"Appworld: A controllable world of apps and people for benchmarking interactive coding agents, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:57.755014Z"},"links":{"cited_paper":"/paper/2407.18901","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:86302db2e212c121172659d6dce04b3d30b776df9f9e589b0d1708992d2dd76a","observation_id":"c56968f5-fefb-43bb-b764-1f379a84f427","resolution":{"observed_at":"2026-08-07T11:40:57.755014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.14803","last_updated":"2025-02-21T16:23:59Z","snapshot_observed_at":"2026-08-12T22:19:48.888953Z","submitted_at":"2024-10-18T18:19:56Z","title":"DistRL: An Asynchronous Distributed Reinforcement Learning Framework for On-Device Control Agents","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.14803","snapshot_observed_at":"2026-08-07T11:40:57.792768Z","title":"Distrl: An asynchronous distributed reinforcement learning framework for on-device control agents, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:57.792768Z"},"links":{"cited_paper":"/paper/2410.14803","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:9f2f04b7eaf8c442c1afaea55f814b63f56aef5cb3ab8ef708dddf207ac3597e","observation_id":"668c004a-9259-4962-93a0-545038760051","resolution":{"observed_at":"2026-08-07T11:40:57.792768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1703.05407","last_updated":"2018-04-27T20:58:12Z","snapshot_observed_at":"2026-08-10T08:31:14.326337Z","submitted_at":"2017-03-15T22:27:43Z","title":"Intrinsic Motivation and Automatic Curricula via Asymmetric Self-Play","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.05407","snapshot_observed_at":"2026-08-07T11:40:57.515236Z","title":"Intrinsic motivation and automatic curricula via asymmetric self-play, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:57.515236Z"},"links":{"cited_paper":"/paper/1703.05407","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:a6ea8a8c6ce4dedcc3d94eb96b600bb4052362daeb6a4fa0e618f3d78a4dcba2","observation_id":"4d5913fc-de68-4b39-ab35-09770eacc699","resolution":{"observed_at":"2026-08-07T11:40:57.515236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:41:10.344869Z","title":"The llama 3 herd of models, 2024","venue":null,"work_id":"2d588296-b9af-408b-b02d-fdcf63e19ab8","year":2024},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:57.703152Z"},"links":{"citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:9bd2d5b51ad0e8be48b418ce1cef309913ab34a4a00b75a32a345515a8fcf3de","observation_id":"7944699a-559c-4c4d-bafc-ae724a4602e5","resolution":{"observed_at":"2026-08-07T11:41:10.502150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:41:09.883399Z","title":"Williams","venue":null,"work_id":"568b3e18-2884-4835-8b42-5f507b94afde","year":2004},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:57.908163Z"},"links":{"citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:4cdb4cb66084b271ade07f96502f164513905baf2e1ad537b35883cf16501d39","observation_id":"2e468fff-96e1-4eef-b693-be3b9530f842","resolution":{"observed_at":"2026-08-07T11:41:10.002527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01622","last_updated":"2024-10-23T15:02:57Z","snapshot_observed_at":"2026-08-13T11:57:55.374642Z","submitted_at":"2024-02-02T18:39:51Z","title":"TravelPlanner: A Benchmark for Real-World Planning with Language Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01622","snapshot_observed_at":"2026-08-07T11:40:57.962659Z","title":"Travelplanner: A benchmark for real-world planning with language agents, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:57.962659Z"},"links":{"cited_paper":"/paper/2402.01622","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:0a0d164d158f2d665f96934040a0af1b66ea7d5740a161977852726ebf58118a","observation_id":"1b6eaf50-65fe-4888-aeed-bbb2b5a13b0d","resolution":{"observed_at":"2026-08-07T11:40:57.962659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:41:10.118989Z","title":"Executable code actions elicit better llm agents, 2024","venue":null,"work_id":"dd3e0d13-62a6-423b-b987-1c09dccffaa5","year":2024},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:57.829147Z"},"links":{"citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:0833b5f18b77781d91df7a0869ccf5643dcc5bbba80726e782b02d8d1906330c","observation_id":"5cd74399-0b7b-453b-aa7f-aef601ca5057","resolution":{"observed_at":"2026-08-07T11:41:10.221816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10560","last_updated":"2023-05-25T23:50:07Z","snapshot_observed_at":"2026-08-13T22:45:34.795769Z","submitted_at":"2022-12-20T18:59:19Z","title":"Self-Instruct: Aligning Language Models with Self-Generated Instructions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10560","snapshot_observed_at":"2026-08-07T11:40:57.896022Z","title":"Smith, Daniel Khashabi, and Hannaneh Hajishirzi","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:57.896022Z"},"links":{"cited_paper":"/paper/2212.10560","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:dd75253eef9c30b7c7acb88a1ce04c8c38815a213bff0537146a63ec8d37edd7","observation_id":"54afcc56-60f7-46b8-b56a-0a1e403c9161","resolution":{"observed_at":"2026-08-07T11:40:57.896022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14161","last_updated":"2025-09-10T08:35:19Z","snapshot_observed_at":"2026-08-01T16:27:28.241667Z","submitted_at":"2024-12-18T18:55:40Z","title":"TheAgentCompany: Benchmarking LLM Agents on Consequential Real World Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14161","snapshot_observed_at":"2026-08-07T11:40:58.089452Z","title":"Xu, Yufan Song, Boxuan Li, Yuxuan Tang, Kritanjali Jain, Mengxue Bao, Zora Z","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:58.089452Z"},"links":{"cited_paper":"/paper/2412.14161","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:de580e53d7c15251ac2b06fe9de6beb8baff0a0b6737bfa68775b9705ff5c727","observation_id":"9d4610b9-1bc1-40d5-a38a-0a7037f0988b","resolution":{"observed_at":"2026-08-07T11:40:58.089452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:41:09.680447Z","title":"Fung, Sha Li, Zixuan Huang, Xu Cao, Xingyao Wang, Yiquan Wang, Heng Ji, and Chengxiang Zhai","venue":null,"work_id":"65eb5ad5-c3fd-4b5d-92c0-cd83559ff14d","year":null},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:58.094965Z"},"links":{"citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:34de3d879b84a82c0f9f0ec69c0df0d23ed717cb5fdaa0fd3f957eeb22cf8312","observation_id":"73a172da-00aa-4749-86ca-5381f9f6f256","resolution":{"observed_at":"2026-08-07T11:41:09.757374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07972","last_updated":"2024-05-30T08:55:12Z","snapshot_observed_at":"2026-08-13T02:44:49.555221Z","submitted_at":"2024-04-11T17:56:05Z","title":"OSWorld: Benchmarking Multimodal Agents for Open-Ended Tasks in Real Computer Environments","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07972","snapshot_observed_at":"2026-08-07T11:40:58.052425Z","title":"Osworld: Benchmarking multimodal agents for open-ended tasks in real computer environments, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:58.052425Z"},"links":{"cited_paper":"/paper/2404.07972","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:e12b90d2ff46e577069e2d0efcea522d324477e2dabb08619e619fdcd6ae7828","observation_id":"e54719fc-d061-4af5-b4c3-0d10d14eea7c","resolution":{"observed_at":"2026-08-07T11:40:58.052425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02392","last_updated":"2025-02-27T22:10:16Z","snapshot_observed_at":"2026-08-12T22:51:52.298132Z","submitted_at":"2024-09-04T02:41:04Z","title":"Building Math Agents with Multi-Turn Iterative Preference Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02392","snapshot_observed_at":"2026-08-07T11:40:58.073304Z","title":"Building math agents with multi-turn iterative preference learning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:58.073304Z"},"links":{"cited_paper":"/paper/2409.02392","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:0f734e52a84f8bd010e85001fea3b6afc2026e983563f4e886d68987b376f94e","observation_id":"a663a407-f076-41a0-aa8d-4a3156ce8dff","resolution":{"observed_at":"2026-08-07T11:40:58.073304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10020","last_updated":"2025-03-28T00:06:51Z","snapshot_observed_at":"2026-08-07T08:02:34.857823Z","submitted_at":"2024-01-18T14:43:47Z","title":"Self-Rewarding Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10020","snapshot_observed_at":"2026-08-07T11:40:58.356648Z","title":"Self-rewarding language models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:58.356648Z"},"links":{"cited_paper":"/paper/2401.10020","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:1d8f8322504acc76cce1f102b043c6d76eb70e2902a39a8310760b7e662337e9","observation_id":"9b24f184-baf4-4673-852c-2dfb7273c58f","resolution":{"observed_at":"2026-08-07T11:40:58.356648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.01711","last_updated":"2024-02-15T02:57:22Z","snapshot_observed_at":"2026-08-13T11:25:32.403659Z","submitted_at":"2023-06-02T17:32:17Z","title":"OMNI: Open-endedness via Models of human Notions of Interestingness","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.01711","snapshot_observed_at":"2026-08-07T11:40:58.439810Z","title":"Omni: Open-endedness via models of human notions of interestingness, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:58.439810Z"},"links":{"cited_paper":"/paper/2306.01711","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:7b105e3840eeeac6613b27d89e21aa48ae6e61b747cd1d0a363dfa0ccaa3041c","observation_id":"10aa5b6b-5496-4ae2-9d7a-4ee6d4e62532","resolution":{"observed_at":"2026-08-07T11:40:58.439810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.00812","last_updated":"2024-01-08T16:22:42Z","snapshot_observed_at":"2026-08-13T04:50:26.564169Z","submitted_at":"2024-01-01T16:51:20Z","title":"If LLM Is the Wizard, Then Code Is the Wand: A Survey on How Code Empowers Large Language Models to Serve as Intelligent Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.00812","snapshot_observed_at":"2026-08-07T11:40:58.149818Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:58.149818Z"},"links":{"cited_paper":"/paper/2401.00812","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:6d710484fa06a677e23be666f86e2df8da50e2091fdb5e06c70df0340a62bbf9","observation_id":"152db4ab-e76c-4598-830a-565b6c63cde2","resolution":{"observed_at":"2026-08-07T11:40:58.149818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03629","last_updated":"2023-03-10T01:00:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-06T01:00:32Z","title":"ReAct: Synergizing Reasoning and Acting in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03629","snapshot_observed_at":"2026-08-07T11:40:58.217468Z","title":"React: Synergizing reasoning and acting in language models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:58.217468Z"},"links":{"cited_paper":"/paper/2210.03629","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:3ba6580d3166d0b769f46c28b9b96a85ff86ec9483670ae5f69f86deb871a9ed","observation_id":"9200b938-1689-4bd8-9392-2c18140e93c8","resolution":{"observed_at":"2026-08-07T11:40:58.217468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12045","last_updated":"2024-06-17T19:33:08Z","snapshot_observed_at":"2026-08-14T00:08:59.565509Z","submitted_at":"2024-06-17T19:33:08Z","title":"$\\tau$-bench: A Benchmark for Tool-Agent-User Interaction in Real-World Domains","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12045","snapshot_observed_at":"2026-08-07T11:40:58.289141Z","title":"τ-bench: A benchmark for tool-agent-user interaction in real-world domains, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:58.289141Z"},"links":{"cited_paper":"/paper/2406.12045","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:47303873e1ed2caa4dc8d77c9aab4bf2c0b877456d1a4f8577333176d7b28eff","observation_id":"8266c9a7-a113-45a3-ae5c-aa8a09a141f8","resolution":{"observed_at":"2026-08-07T11:40:58.289141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.19446","last_updated":"2024-02-29T18:45:56Z","snapshot_observed_at":"2026-08-13T04:06:49.620740Z","submitted_at":"2024-02-29T18:45:56Z","title":"ArCHer: Training Language Model Agents via Hierarchical Multi-Turn RL","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.19446","snapshot_observed_at":"2026-08-07T11:40:58.654310Z","title":"Archer: Training language model agents via hierarchical multi-turn rl, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:58.654310Z"},"links":{"cited_paper":"/paper/2402.19446","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:02056c14a87a70d67c3425104713d3d80d68dfa2e14421667527dc184ec4b95a","observation_id":"fe81ee85-bce5-4ea0-9666-744b80f639c5","resolution":{"observed_at":"2026-08-07T11:40:58.654310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.15478","last_updated":"2025-03-19T17:55:08Z","snapshot_observed_at":"2026-08-08T21:39:18.091217Z","submitted_at":"2025-03-19T17:55:08Z","title":"SWEET-RL: Training Multi-Turn LLM Agents on Collaborative Reasoning Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.15478","snapshot_observed_at":"2026-08-07T11:40:58.657810Z","title":"get_reservation_details","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:58.657810Z"},"links":{"cited_paper":"/paper/2503.15478","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:d19b80a31e53ee80dcf3ad54235caf832edf7c5194964b8b9a7b28e617e08dbd","observation_id":"17e33e8c-9b01-4cc9-a34c-5da8a28ac835","resolution":{"observed_at":"2026-08-07T11:40:58.657810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03335","last_updated":"2025-10-16T08:23:36Z","snapshot_observed_at":"2026-08-11T20:12:00.210052Z","submitted_at":"2025-05-06T09:08:00Z","title":"Absolute Zero: Reinforced Self-play Reasoning with Zero Data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.03335","snapshot_observed_at":"2026-08-07T11:40:58.509212Z","title":"Absolute zero: Reinforced self-play reasoning with zero data, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:58.509212Z"},"links":{"cited_paper":"/paper/2505.03335","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:1984002e7cf406bba1843ee76ba6cd7a2c79fae27049fd3855bb1898c5d40207","observation_id":"a6de11e5-b574-4e06-9e1a-5db9438d4c39","resolution":{"observed_at":"2026-08-07T11:40:58.509212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13854","last_updated":"2024-04-16T15:13:18Z","snapshot_observed_at":"2026-08-06T12:47:01.809185Z","submitted_at":"2023-07-25T22:59:32Z","title":"WebArena: A Realistic Web Environment for Building Autonomous Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13854","snapshot_observed_at":"2026-08-07T11:40:58.622639Z","title":"Xu, Hao Zhu, Xuhui Zhou, Robert Lo, Abishek Sridhar, Xianyi Cheng, Tianyue Ou, Yonatan Bisk, Daniel Fried, Uri Alon, and Graham Neubig","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:58.622639Z"},"links":{"cited_paper":"/paper/2307.13854","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:de1ded507cf69d385503ccce87408e98bf623e48c4f5a5906bb4456c8796d55d","observation_id":"04cc2d64-6626-4b19-9581-e619b5c30386","resolution":{"observed_at":"2026-08-07T11:40:58.622639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13194","last_updated":"2024-12-17T18:59:50Z","snapshot_observed_at":"2026-08-12T14:15:26.966698Z","submitted_at":"2024-12-17T18:59:50Z","title":"Proposer-Agent-Evaluator(PAE): Autonomous Skill Discovery For Foundation Model Internet Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13194","snapshot_observed_at":"2026-08-07T11:40:58.649855Z","title":"Proposer-agent-evaluator(pae): Autonomous skill discovery for foundation model internet agents, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:58.649855Z"},"links":{"cited_paper":"/paper/2412.13194","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:c2b9f2a84bb6a7b54e1a233abf7032ce6b1bd8c34a51ac0c586eb930d7f04124","observation_id":"b86ca1b9-160a-4040-a855-44640c0293b4","resolution":{"observed_at":"2026-08-07T11:40:58.649855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:41:09.406061Z","title":"book_hotel","venue":null,"work_id":"6f82e574-2723-4308-8be1-b254f7e07bf5","year":null},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:58.725577Z"},"links":{"citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:93c751199c4d9a011ae6053e097da47a368761ab97dddb519909a1a2c6d2c2c3","observation_id":"ce4b2e87-9041-4d54-8d72-75dbd4fe54dc","resolution":{"observed_at":"2026-08-07T11:41:09.532150Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:41:09.164466Z","title":null,"venue":null,"work_id":"c8dbeeae-16f8-4da7-8d79-1fb246c99621","year":null},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:58.810051Z"},"links":{"citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:4a800434a83e2f1c6801d689b9ddb796e529db43489c029fda82e8e07ac63822","observation_id":"ea84a94d-1271-4b97-9f62-71d004797953","resolution":{"observed_at":"2026-08-07T11:41:09.288693Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:40:59.986489Z","title":null,"venue":null,"work_id":"ead482fe-4b6b-41c6-bc2f-2367d6cee18a","year":null},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:58.900975Z"},"links":{"citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:e4b0ba0019bce26b9a6a423614a6e2459f620a0ff7d3f47867b6cacc0809c246","observation_id":"de108500-ab37-433a-90e3-c454647d5249","resolution":{"observed_at":"2026-08-07T11:41:08.735978Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:40:59.817079Z","title":null,"venue":null,"work_id":"5d98ed59-db23-476b-a3a8-83d8cfc3a757","year":null},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:58.995440Z"},"links":{"citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:878f8e852f93a3cb46dc71958eea7febd39500d8df6d5d73a192dbb37b75fbf2","observation_id":"1ba7cca5-8bda-48e2-bed5-bc982210b34e","resolution":{"observed_at":"2026-08-07T11:40:59.913561Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:40:59.667138Z","title":"order by mistake","venue":null,"work_id":"7fd24daa-41a2-46aa-a455-3f7a3c612ab0","year":2024},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:59.083259Z"},"links":{"citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:a19295ca8d3d9e7d277687519940b16f3286936a0789907e7fc30ee24a0bd39c","observation_id":"868d2b48-4c99-48ab-b1dc-0a5d626a1325","resolution":{"observed_at":"2026-08-07T11:40:59.733589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:40:11.955244Z","title":"doi: 10.1016/j.robot.2012.05.008","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":2013,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:11.955244Z"},"links":{"citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:862dc8829b8bcf51e397078293714512ba5db00e2cd096445593f13e1b3633ca","observation_id":"38b1a9f2-cdfd-41b1-aa91-b4e89a113c30","resolution":{"observed_at":"2026-08-07T11:40:11.955244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11896","last_updated":"2024-06-14T17:49:55Z","snapshot_observed_at":"2026-08-12T23:42:29.168458Z","submitted_at":"2024-06-14T17:49:55Z","title":"DigiRL: Training In-The-Wild Device-Control Agents with Autonomous Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11896","snapshot_observed_at":"2026-08-07T11:40:11.634772Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:11.634772Z"},"links":{"cited_paper":"/paper/2406.11896","citing_paper":"/paper/2506.01716"},"observation_digest":"sha256:df79e82cf5448a8d879e61630bbae94ce8eedf9d5227531bac988866573eaf85","observation_id":"e7c33ebd-f11e-44f7-a256-d7d3f4bfdf96","resolution":{"observed_at":"2026-08-07T11:40:11.634772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-13T13:26:12.361661Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents"},"reference_resolution":{"displayed":63,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":53,"verified_exact":0,"verified_fuzzy":9},"total_outbound_references":63},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 63 of 63 outbound references and 17 inbound Pith citation observations for arXiv:2506.01716."}