{"as_of":"2026-08-11T07:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:13865652f3a9bdef81c91f32558c2e362fcd002ae12607710034cc04df3c3f3d","coverage":[{"denominator":56,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":56,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:03:30.907605Z","state":"measured"},{"denominator":60,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":60,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T18:37:55.374135Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T13:39:50.584868Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"cited_work":{"arxiv_id":"2506.04287","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.04287","snapshot_observed_at":"2026-07-04T13:39:50.584868Z","title":"Automated skill discovery for language agents through exploration and iterative feedback","venue":null,"work_id":"7ad69216-d142-4976-a0dd-7b2c057eb593","year":2025},"citing_paper":{"arxiv_id":"2605.02913","last_updated":"2026-04-08T00:53:29Z","snapshot_observed_at":"2026-07-06T23:15:55.848885Z","submitted_at":"2026-04-08T00:53:29Z","title":"Generate, Filter, Control, Replay: A Comprehensive Survey of Rollout Strategies for LLM Reinforcement Learning","version":1},"reference_index":153,"source":"arxiv_source","source_observed_at":"2026-05-10T19:15:27.406778Z"},"links":{"cited_paper":"/paper/2506.04287","citing_paper":"/paper/2605.02913"},"observation_digest":"sha256:c0ab6fe9d47f00f34fe24f134950ed628423a168141fbaf322d571bcb42a0ed3","observation_id":"a9521675-1338-44e1-9fd1-7a1fcd88acd6","resolution":{"observed_at":"2026-05-10T23:15:49.668477Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"cited_work":{"arxiv_id":"2506.04287","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.04287","snapshot_observed_at":"2026-07-04T13:39:50.584868Z","title":"Automated skill discovery for language agents through exploration and iterative feedback","venue":null,"work_id":"7ad69216-d142-4976-a0dd-7b2c057eb593","year":2025},"citing_paper":{"arxiv_id":"2606.08671","last_updated":"2026-07-06T18:50:16Z","snapshot_observed_at":"2026-08-05T17:50:36.183050Z","submitted_at":"2026-06-07T15:21:08Z","title":"SkillHone: A Harness for Continual Agent Skill Evolution Through Persistent Decision History","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-06-27T18:37:55.374135Z"},"links":{"cited_paper":"/paper/2506.04287","citing_paper":"/paper/2606.08671"},"observation_digest":"sha256:bd12f125546fea0011e7141927d79057be5fd459c781d6690b361ae873bafed7","observation_id":"fbe65fd5-d18a-4dea-ab9b-1b4ff2b7432e","resolution":{"observed_at":"2026-07-02T22:47:26.254675Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"cited_work":{"arxiv_id":"2506.04287","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.04287","snapshot_observed_at":"2026-07-04T13:39:50.584868Z","title":"Automated skill discovery for language agents through exploration and iterative feedback","venue":null,"work_id":"7ad69216-d142-4976-a0dd-7b2c057eb593","year":2025},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2506.04287","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:8b31925f38cf15b7af19a076449f067e36395e6886ea2c8f7222f913dd8d2212","observation_id":"f519e037-47cb-4232-93ec-7bcf3a0b64f0","resolution":{"observed_at":"2026-07-02T22:57:25.856666Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"cited_work":{"arxiv_id":"2506.04287","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.04287","snapshot_observed_at":"2026-07-04T13:39:50.584868Z","title":"Automated skill discovery for language agents through exploration and iterative feedback","venue":null,"work_id":"7ad69216-d142-4976-a0dd-7b2c057eb593","year":2025},"citing_paper":{"arxiv_id":"2606.26669","last_updated":"2026-06-25T07:02:32Z","snapshot_observed_at":"2026-07-29T15:47:51.578239Z","submitted_at":"2026-06-25T07:02:32Z","title":"SKILL-DISCO: Distilling and Compiling Agent Traces into Reusable Procedural Skills","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-06-26T05:03:35.457624Z"},"links":{"cited_paper":"/paper/2506.04287","citing_paper":"/paper/2606.26669"},"observation_digest":"sha256:bac177eb9afd0420c4768afefa6316c0b491caf0bf02ac9699f78c239836b5db","observation_id":"de972c30-1bde-40f2-b7e7-1512d1d73fd9","resolution":{"observed_at":"2026-07-04T13:39:50.586534Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.04287/citation-record","integrity":"/paper/2506.04287/integrity","json":"/paper/2506.04287/citation-record.json","paper":"/paper/2506.04287"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1807.10299","last_updated":"2018-07-26T18:05:45Z","snapshot_observed_at":"2026-08-10T10:52:16.340215Z","submitted_at":"2018-07-26T18:05:45Z","title":"Variational Option Discovery Algorithms","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.10299","snapshot_observed_at":"2026-08-07T11:03:25.822971Z","title":"Variational option discovery algorithms","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:25.822971Z"},"links":{"cited_paper":"/paper/1807.10299","citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:3a10287e655c30256adc5a7f2f36a508153adb15152c2a048ad1a8637951434b","observation_id":"0ab9985b-b96a-4df7-9e36-d89cac920609","resolution":{"observed_at":"2026-08-07T11:03:25.822971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-07T11:03:25.898272Z","title":"Fireact: Toward language agent fine-tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:25.898272Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:a1865c41e211d582a4cfa02ec6dea0059df6f16e48153c4b8e2553c76bde66be","observation_id":"1ac41ca7-a31c-4ac2-885e-2f056241fcbe","resolution":{"observed_at":"2026-08-07T11:03:25.898272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:03:34.990028Z","title":"Mind2web: Towards a generalist agent for the web","venue":null,"work_id":"84ef56cf-12ab-4082-8257-cc39d13aee37","year":2023},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:25.999870Z"},"links":{"citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:d216d9a9507a45c64ff9e2eaca92468f8343578b111c1282bf929fc14addbc9d","observation_id":"6e17bb1d-f86c-4a73-ba9a-116714fb9ae1","resolution":{"observed_at":"2026-08-07T11:03:35.056483Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:03:34.819410Z","title":"Emergent complexity and zero-shot transfer via unsupervised environment design","venue":null,"work_id":"78ad77af-2711-4165-905c-1541aa0c4819","year":2020},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:26.123499Z"},"links":{"citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:42860b678254abe9c40955c4cf28022076f882766826bb330cc1bbbefc779bf8","observation_id":"6a38fe2d-1f29-4a32-828a-4b9469d7eae5","resolution":{"observed_at":"2026-08-07T11:03:34.896987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:03:34.626875Z","title":"Guiding pretraining in reinforcement learning with large language models","venue":null,"work_id":"581f73de-6450-444f-9123-f0b95799c1c3","year":2023},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:26.199768Z"},"links":{"citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:051cfd2bfe54be07af35da2eef17ddcc7d84a5c0b965a15559690fc2f7365bfc","observation_id":"18c5c05c-2996-4ed9-8338-803627b57746","resolution":{"observed_at":"2026-08-07T11:03:34.718439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1802.06070","last_updated":"2018-10-09T23:19:52Z","snapshot_observed_at":"2026-08-10T06:42:50.901760Z","submitted_at":"2018-02-16T18:57:57Z","title":"Diversity is All You Need: Learning Skills without a Reward Function","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.06070","snapshot_observed_at":"2026-08-07T11:03:26.274166Z","title":"Diversity is all you need: Learning skills without a reward function","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:26.274166Z"},"links":{"cited_paper":"/paper/1802.06070","citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:4dde3785d1a312a650777eb4d15c0eb0c91611bc9b010dd75bea683f8d8f7b52","observation_id":"0b8943a3-2a20-48fb-b35c-63242f273e51","resolution":{"observed_at":"2026-08-07T11:03:26.274166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15568","last_updated":"2025-02-14T14:24:59Z","snapshot_observed_at":"2026-07-06T18:19:21.735356Z","submitted_at":"2024-05-24T13:57:32Z","title":"OMNI-EPIC: Open-endedness via Models of human Notions of Interestingness with Environments Programmed in Code","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.15568","snapshot_observed_at":"2026-08-07T11:03:26.369118Z","title":"Omni-epic: Open-endedness via models of human notions of interestingness with environments programmed in code","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:26.369118Z"},"links":{"cited_paper":"/paper/2405.15568","citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:99e2830cf1a99b42d5115cf5306e98bf936a9e2d6c9cf06aafd40b8c83ddd575","observation_id":"b6583d0c-6308-46fd-9fb3-6eeb0cda2849","resolution":{"observed_at":"2026-08-07T11:03:26.369118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:03:34.380714Z","title":"Automatic goal generation for reinforcement learning agents","venue":null,"work_id":"5c22d52e-4877-4fd9-84a2-c951deb99cfd","year":2018},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:26.431916Z"},"links":{"citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:9aebae2cfdde697edde8837c9c4f6b3b3d47cb69d0819443953b9af07c81ac2d","observation_id":"42f0b07b-99a7-4878-840c-4c883bf3c048","resolution":{"observed_at":"2026-08-07T11:03:34.513776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T11:03:26.535427Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:26.535427Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:86715621a93ea3becfab46182b6342b9c8566eb04ccc4c0757bd98ea40b9155f","observation_id":"c2e78acc-a2dc-4968-a635-029dd4acd4aa","resolution":{"observed_at":"2026-08-07T11:03:26.535427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:03:34.170724Z","title":"Benchmarking the spectrum of agent capabilities","venue":null,"work_id":"65da9022-fbce-4a3c-b29b-6f23195615d6","year":2022},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:26.599008Z"},"links":{"citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:68fb05132f1f9d008bd0458965e5207e768f5a19954dcd52fc9c21e665cd83d8","observation_id":"ea233952-099f-4a2e-b0b9-190f77d862e9","resolution":{"observed_at":"2026-08-07T11:03:34.272353Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13919","last_updated":"2024-06-06T18:37:34Z","snapshot_observed_at":"2026-08-09T21:47:22.232349Z","submitted_at":"2024-01-25T03:33:18Z","title":"WebVoyager: Building an End-to-End Web Agent with Large Multimodal Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13919","snapshot_observed_at":"2026-08-07T11:03:26.700075Z","title":"Webvoyager: Building an end-to-end web agent with large multimodal models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:26.700075Z"},"links":{"cited_paper":"/paper/2401.13919","citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:f7b0529943264f040ff035dfb95dac12ea882205151a14b3e2fab2b6a479d068","observation_id":"4f578e32-4a3f-40cb-b6de-fbc3bf95af79","resolution":{"observed_at":"2026-08-07T11:03:26.700075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.19609","last_updated":"2024-10-25T15:01:27Z","snapshot_observed_at":"2026-07-06T19:39:47.007952Z","submitted_at":"2024-10-25T15:01:27Z","title":"OpenWebVoyager: Building Multimodal Web Agents via Iterative Real-World Exploration, Feedback and Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.19609","snapshot_observed_at":"2026-08-07T11:03:26.768525Z","title":"Openwebvoyager: Building multimodal web agents via iterative real-world exploration, feedback and optimization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:26.768525Z"},"links":{"cited_paper":"/paper/2410.19609","citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:0a2303d06fe9a232fb6fc938f603f51337da64b019e86de40f67c700597afb77","observation_id":"66d50625-b891-4aed-ace9-db0823aae1c2","resolution":{"observed_at":"2026-08-07T11:03:26.768525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01118","last_updated":"2024-04-02T15:46:35Z","snapshot_observed_at":"2026-08-06T08:24:17.984186Z","submitted_at":"2024-02-02T03:22:12Z","title":"PokeLLMon: A Human-Parity Agent for Pokemon Battles with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01118","snapshot_observed_at":"2026-08-07T11:03:26.888965Z","title":"Pokéllmon: A human-parity agent for pokémon battles with large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:26.888965Z"},"links":{"cited_paper":"/paper/2402.01118","citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:249082afd9fc9d2e93d6cd21171c3a1cd1fc1354aa2d75d8ac0afe7588c7ea43","observation_id":"a82b0163-68eb-4292-87b9-5136b0fe8989","resolution":{"observed_at":"2026-08-07T11:03:26.888965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:03:26.976890Z","title":"Language models as zero-shot planners: Extracting actionable knowledge for embodied agents","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:26.976890Z"},"links":{"citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:ee6ff91b5f543d948a3e85bb5fcd48735421a1756820e3615d85c4457da12115","observation_id":"67839074-5a44-45b2-a04e-f08c049c142c","resolution":{"observed_at":"2026-08-07T11:03:26.976890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T11:03:27.078439Z","title":"Gpt-4o system card","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:27.078439Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:511a379fde501ffe7a1e2bfb2c2d8398cbcf48924c8c199672b2b2a23b801d1c","observation_id":"3b905b5b-0efa-48ac-88aa-190aec4450e2","resolution":{"observed_at":"2026-08-07T11:03:27.078439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.10729","last_updated":"2018-11-29T18:10:13Z","snapshot_observed_at":"2026-07-06T06:47:13.466443Z","submitted_at":"2018-06-28T01:16:11Z","title":"Illuminating Generalization in Deep Reinforcement Learning through Procedural Level Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.10729","snapshot_observed_at":"2026-08-07T11:03:27.155990Z","title":"Illuminating generalization in deep reinforcement learning through procedural level generation","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:27.155990Z"},"links":{"cited_paper":"/paper/1806.10729","citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:062b2ddf62f03454ac98580ab9cbc0a075b0deaadbe8605a1dbe057859aab4aa","observation_id":"9c6c7823-92cd-41e4-a006-516e73cff31b","resolution":{"observed_at":"2026-08-07T11:03:27.155990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06215","last_updated":"2025-03-13T17:30:48Z","snapshot_observed_at":"2026-08-09T07:59:15.746071Z","submitted_at":"2024-10-08T17:20:37Z","title":"DataEnvGym: Data Generation Agents in Teacher Environments with Student Feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06215","snapshot_observed_at":"2026-08-07T11:03:27.229732Z","title":"Dataenvgym: Data generation agents in teacher environments with student feedback","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:27.229732Z"},"links":{"cited_paper":"/paper/2410.06215","citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:25e8651e3cd7c71b1b1d2b4dbfb1977bf02fc8daafe739944f33e1137aa73800","observation_id":"337970c5-63e6-4fb6-89ed-9a2f5323c6db","resolution":{"observed_at":"2026-08-07T11:03:27.229732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:03:27.308410Z","title":"Tree search for language model agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:27.308410Z"},"links":{"citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:3dd6c666ba2ec4b0313bb36e39bcaa03bcb900606967223e205c968e72aef89e","observation_id":"4ceb284d-727c-4bb7-b356-c074b76ae856","resolution":{"observed_at":"2026-08-07T11:03:27.308410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:03:33.989232Z","title":"Autowebglm: A large language model- based web navigating agent","venue":null,"work_id":"9adeb608-35be-446a-95f9-06dae4ae2ca5","year":2024},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:27.379252Z"},"links":{"citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:4f70a999de67904f0598959b1c1ed13d27e74da584a1ba84975bf9f64d3ff74c","observation_id":"79a56932-f8fc-4c29-8c8f-c2dd52e78ab1","resolution":{"observed_at":"2026-08-07T11:03:34.068000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:03:33.796067Z","title":"Unsupervised reinforcement learning with contrastive intrinsic control","venue":null,"work_id":"cb645241-b090-4344-8a78-1596d39536c5","year":2022},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:27.500008Z"},"links":{"citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:f818e9b3416773f22e394d7a2bbe4b678e26efb80c75fd3a3be5d809344d652f","observation_id":"ecec396b-6a7e-4d14-850f-c1ebb1a1f658","resolution":{"observed_at":"2026-08-07T11:03:33.906592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16660","last_updated":"2025-07-21T02:55:09Z","snapshot_observed_at":"2026-08-04T12:26:21.610975Z","submitted_at":"2024-04-25T14:56:32Z","title":"Benchmarking Mobile Device Control Agents across Diverse Configurations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16660","snapshot_observed_at":"2026-08-07T11:03:27.589628Z","title":"Benchmarking mobile device control agents across diverse configurations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:27.589628Z"},"links":{"cited_paper":"/paper/2404.16660","citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:a6ed06336428dc22569019b5ea839bb626fa19f28b74b52a3d4e41833367d93a","observation_id":"a9aab2d3-e448-45a5-866e-ada7183d5c40","resolution":{"observed_at":"2026-08-07T11:03:27.589628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.00528","last_updated":"2019-02-17T00:23:55Z","snapshot_observed_at":"2026-08-02T02:12:09.648585Z","submitted_at":"2019-02-01T19:23:58Z","title":"Competitive Experience Replay","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.00528","snapshot_observed_at":"2026-08-07T11:03:27.665012Z","title":"Competitive experience replay","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:27.665012Z"},"links":{"cited_paper":"/paper/1902.00528","citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:be58cdd56b8271d1ec0d2fc714454b02d5d5a84576ac379c81d41eb91be5b8a4","observation_id":"8522c990-18b0-4077-a5cb-feac09909bac","resolution":{"observed_at":"2026-08-07T11:03:27.665012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:03:27.742181Z","title":"Weblinx: Real-world website navigation with multi-turn dialogue","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:27.742181Z"},"links":{"citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:f2c49a17a5ec26b29f062bd94955f59790c0d7ffd4db748b32470605d625359d","observation_id":"e0c742d5-f210-472c-baa9-ba357b71a29d","resolution":{"observed_at":"2026-08-07T11:03:27.742181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02907","last_updated":"2025-02-05T18:56:51Z","snapshot_observed_at":"2026-07-06T19:27:20.458797Z","submitted_at":"2024-10-03T18:56:51Z","title":"NNetNav: Unsupervised Learning of Browser Agents Through Environment Interaction in the Wild","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02907","snapshot_observed_at":"2026-08-07T11:03:27.809974Z","title":"Nnetscape navigator: Complex demonstrations for web agents without a demonstrator","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:27.809974Z"},"links":{"cited_paper":"/paper/2410.02907","citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:792e400af31f0e41e0a57ab473cd702226316d190d89423d82e4d035b85a1828","observation_id":"05674ba6-ef51-4d28-a03c-bbc3aa619128","resolution":{"observed_at":"2026-08-07T11:03:27.809974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:03:33.665571Z","title":"Bagel: Bootstrapping agents by guiding exploration with language","venue":null,"work_id":"644d4a14-2c7f-4d72-beb4-a3434b83c826","year":2024},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:27.860436Z"},"links":{"citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:02282ce4528760c37f195ba3e5472b3e6f3bc36a01e23bd844793d4f8453c7a8","observation_id":"e799eca2-72cd-497e-8185-e216d779606e","resolution":{"observed_at":"2026-08-07T11:03:33.732780Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08958","last_updated":"2023-12-14T14:07:41Z","snapshot_observed_at":"2026-07-06T17:01:44.940193Z","submitted_at":"2023-12-14T14:07:41Z","title":"LiFT: Unsupervised Reinforcement Learning with Foundation Models as Teachers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.08958","snapshot_observed_at":"2026-08-07T11:03:27.944964Z","title":"Lift: Unsupervised reinforcement learning with foundation models as teachers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:27.944964Z"},"links":{"cited_paper":"/paper/2312.08958","citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:ca276dc24d7588171d9d160d65a7aaa2158e905cf2fcc9c624e39c906f9c2905","observation_id":"488e211f-d605-477c-a681-2f58508d4a4b","resolution":{"observed_at":"2026-08-07T11:03:27.944964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.04882","last_updated":"2021-01-13T05:20:20Z","snapshot_observed_at":"2026-08-05T15:46:28.102967Z","submitted_at":"2021-01-13T05:20:20Z","title":"Asymmetric self-play for automatic goal discovery in robotic manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.04882","snapshot_observed_at":"2026-08-07T11:03:28.037262Z","title":"Asymmetric self-play for automatic goal discovery in robotic manipulation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:28.037262Z"},"links":{"cited_paper":"/paper/2101.04882","citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:a70f2803f0e434cb351bc705315eb5e067fe1be5816ec642e18358912a82d70e","observation_id":"634f9460-6bfc-403f-8bfb-fe6e1991ade3","resolution":{"observed_at":"2026-08-07T11:03:28.037262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:03:33.494579Z","title":"Balrog: Bench- marking agentic llm and vlm reasoning on games","venue":null,"work_id":"a06ed2b7-abcd-4bf9-99fc-895267dacb02","year":2025},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:28.126974Z"},"links":{"citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:0fa907a80452f08125fab27479df6a0b48f6dcab1bced105c77956d4f8aef9e1","observation_id":"c36a30e3-5bda-43a7-b93a-6d06b1404b6e","resolution":{"observed_at":"2026-08-07T11:03:33.576120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11357","last_updated":"2025-05-30T02:30:57Z","snapshot_observed_at":"2026-08-07T18:13:59.301597Z","submitted_at":"2025-02-17T02:13:48Z","title":"Explorer: Scaling Exploration-driven Web Trajectory Synthesis for Multimodal Web Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11357","snapshot_observed_at":"2026-08-07T11:03:28.263675Z","title":"Explorer: Scaling exploration-driven web trajectory synthesis for multimodal web agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:28.263675Z"},"links":{"cited_paper":"/paper/2502.11357","citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:e4d194e04a6603d288447adfb7eba1d76541c7323e74b21aeb3505851f576f0a","observation_id":"ebb98b00-a759-4575-8cd2-94a9444b4612","resolution":{"observed_at":"2026-08-07T11:03:28.263675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:03:33.330894Z","title":"Lipschitz- constrained unsupervised skill discovery","venue":null,"work_id":"75811528-d8b2-4995-b6fe-e69900c1de5d","year":2022},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:28.364199Z"},"links":{"citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:969b5e0ddbcb0bdff63b837db18d61660eedd6198b19493ae0c9dc28d56a857d","observation_id":"8c74bece-053e-48a5-a5d5-fb27551fcbab","resolution":{"observed_at":"2026-08-07T11:03:33.394607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:03:33.154235Z","title":"Accelerating reinforcement learning with learned skill priors","venue":null,"work_id":"2deb1679-e545-446e-a80c-9cb3aceae53b","year":2021},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:28.477573Z"},"links":{"citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:37bec78cd2f6271f75b41f039b511408a164a7bc3ad17caeb1917faaeb70c6a1","observation_id":"704a9429-999e-460c-8b6e-f3e02914ac6d","resolution":{"observed_at":"2026-08-07T11:03:33.216401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.03698","last_updated":"2020-08-04T04:07:27Z","snapshot_observed_at":"2026-07-06T07:38:07.496179Z","submitted_at":"2019-03-08T23:32:17Z","title":"Skew-Fit: State-Covering Self-Supervised Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1903.03698","snapshot_observed_at":"2026-08-07T11:03:28.595829Z","title":"Skew-fit: State-covering self-supervised reinforcement learning","venue":null,"work_id":null,"year":1903},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:28.595829Z"},"links":{"cited_paper":"/paper/1903.03698","citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:9bf1bfc7ec0bacb8031023b30927efe419892595dbaad0575c145d067177ba35","observation_id":"017bcc25-aebd-4488-a748-ab051c631b87","resolution":{"observed_at":"2026-08-07T11:03:28.595829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:03:32.946777Z","title":"Androidworld: A dynamic benchmarking environment for autonomous agents","venue":null,"work_id":"572422a6-01d2-4a1d-8ca7-efa0213ca247","year":2025},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:28.696270Z"},"links":{"citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:93e97b91d9bd9bc84b2ac8ed3ecf3c195180d8aefe3237e4e161529385c5c2db","observation_id":"c5baef8c-f312-41be-855f-8bc431a1338f","resolution":{"observed_at":"2026-08-07T11:03:33.020514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:03:32.814629Z","title":"Reflexion: Language agents with verbal reinforcement learning.Advances in Neural Information Processing Systems, 2023","venue":null,"work_id":"3b3d9173-d317-42d4-9189-a330504b166f","year":2023},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:28.750473Z"},"links":{"citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:82283af800ee9bd3e1192378996b840c5803dd8eb803202e2dfcf26ea01fade8","observation_id":"4eeba095-8a8a-41d2-9c4b-4e30f98584c3","resolution":{"observed_at":"2026-08-07T11:03:32.863729Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.10893","last_updated":"2025-01-18T22:34:41Z","snapshot_observed_at":"2026-08-10T22:27:08.878421Z","submitted_at":"2025-01-18T22:34:41Z","title":"Learn-by-interact: A Data-Centric Framework for Self-Adaptive Agents in Realistic Environments","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.10893","snapshot_observed_at":"2026-08-07T11:03:28.855289Z","title":"Learn-by- interact: A data-centric framework for self-adaptive agents in realistic environments","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:28.855289Z"},"links":{"cited_paper":"/paper/2501.10893","citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:160f607f7d88102a50c5d99025963403c511e9f2c316c99563aeab8252fd0e5f","observation_id":"86ac7cf5-2243-411a-8a22-63e118e12f77","resolution":{"observed_at":"2026-08-07T11:03:28.855289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:03:32.682441Z","title":"Between mdps and semi-mdps: A framework for temporal abstraction in reinforcement learning","venue":null,"work_id":"5013ca60-3f1b-4aa0-8cc4-9a360979dea4","year":1999},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:28.978049Z"},"links":{"citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:813d67b158b2abb0577329235e80e92415fb234a6e664595bcfdd94a0dbf1174","observation_id":"78bac3d6-a90f-4b47-a82c-e9a1c09a807b","resolution":{"observed_at":"2026-08-07T11:03:32.758345Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.12808","last_updated":"2021-07-31T16:55:19Z","snapshot_observed_at":"2026-08-09T10:48:10.505366Z","submitted_at":"2021-07-27T13:30:07Z","title":"Open-Ended Learning Leads to Generally Capable Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.12808","snapshot_observed_at":"2026-08-07T11:03:29.057904Z","title":"Open- ended learning leads to generally capable agents","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:29.057904Z"},"links":{"cited_paper":"/paper/2107.12808","citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:bb58ab53e7cd603c0cadb4a7a246e120fbab5d84dd275c663718b48c7b4dc300","observation_id":"abd0e088-0109-4ed7-82e1-872d4053e928","resolution":{"observed_at":"2026-08-07T11:03:29.057904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16291","last_updated":"2023-10-19T16:27:03Z","snapshot_observed_at":"2026-08-07T08:29:46.650400Z","submitted_at":"2023-05-25T17:46:38Z","title":"Voyager: An Open-Ended Embodied Agent with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16291","snapshot_observed_at":"2026-08-07T11:03:29.122001Z","title":"V oyager: An open-ended embodied agent with large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:29.122001Z"},"links":{"cited_paper":"/paper/2305.16291","citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:175eeab0d4a0a932925fa98a770c733d527536af0df73718f7e212778dd8a36e","observation_id":"74b40594-2c33-493c-a6a8-b17576a88022","resolution":{"observed_at":"2026-08-07T11:03:29.122001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1901.01753","last_updated":"2019-02-21T01:17:31Z","snapshot_observed_at":"2026-08-10T09:06:00.813932Z","submitted_at":"2019-01-07T11:28:36Z","title":"Paired Open-Ended Trailblazer (POET): Endlessly Generating Increasingly Complex and Diverse Learning Environments and Their Solutions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.01753","snapshot_observed_at":"2026-08-07T11:03:29.229207Z","title":"Paired open-ended trailblazer (poet): Endlessly generating increasingly complex and diverse learning environments and their solutions","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:29.229207Z"},"links":{"cited_paper":"/paper/1901.01753","citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:1cc6d20e0174cb896ddd4e8bfa858a4aede935b75786e080d3df7a218bb00425","observation_id":"322b08e6-0357-46b8-a7a1-4d2a4cac3a6a","resolution":{"observed_at":"2026-08-07T11:03:29.229207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:03:29.338089Z","title":"Osworld: Benchmarking multimodal agents for open-ended tasks in real computer environments","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:29.338089Z"},"links":{"citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:38396d4962c1b8f1d2e303e92015712bec644550d8b11c4489dd48d065443f48","observation_id":"9db23e1b-adfa-4b28-a065-d4a68766d11d","resolution":{"observed_at":"2026-08-07T11:03:29.338089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T11:03:29.407074Z","title":"Qwen2.5 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:29.407074Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:c23b493058e05876a62d377e0f68127abd7e175a29fad5a3a4e662e7984af8cf","observation_id":"4062c452-38b2-4f84-85d2-4f95a5eb7cbf","resolution":{"observed_at":"2026-08-07T11:03:29.407074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:03:32.485358Z","title":"Webshop: Towards scalable real-world web interaction with grounded language agents","venue":null,"work_id":"6a30c38a-d52b-4f5f-90f2-cfb18bb0fa59","year":2022},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:29.545300Z"},"links":{"citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:08004b6c1731e315f1d15f63678a4ed4c60d7ce1c96152cc3d5b42b1469bd95d","observation_id":"072215cf-aab4-4c81-a214-27e70e67ab8f","resolution":{"observed_at":"2026-08-07T11:03:32.580264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:03:29.626585Z","title":"React: Synergizing reasoning and acting in language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:29.626585Z"},"links":{"citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:0110731b40ae7d273dcd578e8ba5a949199bc02ae683feae407c3de416f9ffde","observation_id":"ddf49a7f-7c9d-4cea-bcc5-3efc2af5cef5","resolution":{"observed_at":"2026-08-07T11:03:29.626585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.16563","last_updated":"2023-12-04T14:53:15Z","snapshot_observed_at":"2026-08-06T03:10:19.709154Z","submitted_at":"2023-03-29T09:45:50Z","title":"Skill Reinforcement Learning and Planning for Open-World Long-Horizon Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.16563","snapshot_observed_at":"2026-08-07T11:03:29.691987Z","title":"Skill reinforcement learning and planning for open-world long-horizon tasks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:29.691987Z"},"links":{"cited_paper":"/paper/2303.16563","citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:5ac007110013ddf1877fe53f3882a668d125b54fb5819181f24168cd21d25348","observation_id":"32b89ad3-01d7-4694-a7af-8cc8b92086b1","resolution":{"observed_at":"2026-08-07T11:03:29.691987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.12823","last_updated":"2023-10-22T16:19:16Z","snapshot_observed_at":"2026-08-07T22:31:11.195198Z","submitted_at":"2023-10-19T15:19:53Z","title":"AgentTuning: Enabling Generalized Agent Abilities for LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.12823","snapshot_observed_at":"2026-08-07T11:03:29.806310Z","title":"Agenttuning: Enabling generalized agent abilities for llms","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:29.806310Z"},"links":{"cited_paper":"/paper/2310.12823","citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:8976e29be7d85dee9f188d67e4c8c387dd62964a992b5ac11b15c6178f88da69","observation_id":"5945f212-43e6-4604-aa8f-faf09b6d96d3","resolution":{"observed_at":"2026-08-07T11:03:29.806310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.01711","last_updated":"2024-02-15T02:57:22Z","snapshot_observed_at":"2026-07-06T15:37:16.278040Z","submitted_at":"2023-06-02T17:32:17Z","title":"OMNI: Open-endedness via Models of human Notions of Interestingness","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.01711","snapshot_observed_at":"2026-08-07T11:03:29.887117Z","title":"Omni: Open-endedness via models of human notions of interestingness","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:29.887117Z"},"links":{"cited_paper":"/paper/2306.01711","citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:cfcff738c941a9175f27e8cd3894522c1621c7859abe0543b8ce19743a371063","observation_id":"9a23aa97-d5ea-426a-8e65-38556fbb4eef","resolution":{"observed_at":"2026-08-07T11:03:29.887117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10021","last_updated":"2023-10-17T12:01:17Z","snapshot_observed_at":"2026-07-06T16:33:30.170449Z","submitted_at":"2023-10-16T02:43:47Z","title":"Bootstrap Your Own Skills: Learning to Solve New Tasks with Large Language Model Guidance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10021","snapshot_observed_at":"2026-08-07T11:03:29.961117Z","title":"Bootstrap your own skills: Learning to solve new tasks with large language model guidance","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:29.961117Z"},"links":{"cited_paper":"/paper/2310.10021","citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:3fcb067204ab41c1c2ea4f99750d5d6fef10cdeae7e72643c2368d33945ec870","observation_id":"69085d9d-f981-42b0-af6e-6b402b3c108c","resolution":{"observed_at":"2026-08-07T11:03:29.961117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07079","last_updated":"2025-04-09T17:51:50Z","snapshot_observed_at":"2026-07-06T21:06:50.056353Z","submitted_at":"2025-04-09T17:51:50Z","title":"SkillWeaver: Web Agents can Self-Improve by Discovering and Honing Skills","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07079","snapshot_observed_at":"2026-08-07T11:03:30.102392Z","title":"Skillweaver: Web agents can self-improve by discovering and honing skills","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:30.102392Z"},"links":{"cited_paper":"/paper/2504.07079","citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:6d2e4a1b6fa13ddeef7c82681e4713db46826bceff151a04db2c05b2e51d1ca2","observation_id":"4b0e4d92-bf31-42da-9d46-796bfc215f4a","resolution":{"observed_at":"2026-08-07T11:03:30.102392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:03:32.266852Z","title":"Xu, Hao Zhu, Xuhui Zhou, Robert Lo, Abishek Sridhar, Xianyi Cheng, Tianyue Ou, Yonatan Bisk, Daniel Fried, Uri Alon, and Graham Neubig","venue":null,"work_id":"32297b55-b63b-494c-8855-99a3967e8f42","year":2024},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:30.204007Z"},"links":{"citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:c4ddd884668344ebe29d4377d8b2a7809262d51ec8b49347982c466c465ad4f1","observation_id":"cededf8a-dc85-4318-8a83-feb4550efcb3","resolution":{"observed_at":"2026-08-07T11:03:32.352897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13194","last_updated":"2024-12-17T18:59:50Z","snapshot_observed_at":"2026-08-03T11:34:22.888935Z","submitted_at":"2024-12-17T18:59:50Z","title":"Proposer-Agent-Evaluator(PAE): Autonomous Skill Discovery For Foundation Model Internet Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13194","snapshot_observed_at":"2026-08-07T11:03:30.304449Z","title":"Proposer-agent-evaluator (pae): Autonomous skill discovery for foundation model internet agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:30.304449Z"},"links":{"cited_paper":"/paper/2412.13194","citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:a062363d4e17842abab0f444a0d041cff4b9d6f7706e74c8e75fb7e53b953dcf","observation_id":"ea5536c0-bbce-4aa7-a322-e979271ac04c","resolution":{"observed_at":"2026-08-07T11:03:30.304449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.19446","last_updated":"2024-02-29T18:45:56Z","snapshot_observed_at":"2026-08-10T19:23:03.774922Z","submitted_at":"2024-02-29T18:45:56Z","title":"ArCHer: Training Language Model Agents via Hierarchical Multi-Turn RL","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.19446","snapshot_observed_at":"2026-08-07T11:03:30.382349Z","title":"Find me double sided, machine washable decorative pillows with printing technology with size: 28","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:30.382349Z"},"links":{"cited_paper":"/paper/2402.19446","citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:420554c461f432cfd5b3149044367927f14dc2ff17f08e06327e73b90ae08b5c","observation_id":"630fbc79-01bf-4030-8d21-19eaea262789","resolution":{"observed_at":"2026-08-07T11:03:30.382349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:03:31.824243Z","title":"HTML Element","venue":null,"work_id":"b2a5c0bc-9196-44eb-aa87-7166f1e86dd6","year":null},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:30.530802Z"},"links":{"citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:346ff447dd190251bc665a8b5e3b95ccf6e6c244c38b7e8dd121e82cf50d9519","observation_id":"c742e5b0-bc06-45f7-b46a-4acf2b8aabc2","resolution":{"observed_at":"2026-08-07T11:03:31.932407Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:03:32.049064Z","title":"[button] Search [button_]","venue":null,"work_id":"14bf65b0-beab-43b0-a907-7aa52b46eea6","year":null},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:30.617653Z"},"links":{"citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:9dd9b63f2135d0186b8a4dbfb35e3339b5180b00191668cbdcb056d8cca7e86e","observation_id":"5675d98a-ce4b-4aa2-aaee-7759dd8e7b27","resolution":{"observed_at":"2026-08-07T11:03:32.151987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:03:31.614891Z","title":"HTML Element","venue":null,"work_id":"ca10d6a0-fca2-4347-9b78-c9236bb510c1","year":null},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:30.704096Z"},"links":{"citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:bea6067746db236c1cbffc34b25b0da680f4babd16a26bdd5ba6a4d69a99cb30","observation_id":"a0e1dcac-a190-44b0-be27-729e07bef74e","resolution":{"observed_at":"2026-08-07T11:03:31.719594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:03:31.441632Z","title":"Refrain from B during your exploration","venue":null,"work_id":"1d31849d-0770-415d-b42a-904b42f2a67a","year":null},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:30.818274Z"},"links":{"citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:d108ebc914ff0f49a55fd5ae803e646722e38fda68908728cc6ee36d2ea281b8","observation_id":"79512170-f70f-40e2-84ed-d87277b7ec76","resolution":{"observed_at":"2026-08-07T11:03:31.511373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:03:31.335639Z","title":"last action","venue":null,"work_id":"8882fa5e-51c6-4684-9562-046c4074e926","year":null},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:30.907605Z"},"links":{"citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:703edfd9193d04df2a64eaf4ae0919e73b129ab3ed3ad758c81f9d1c81f2243e","observation_id":"ec6dd4e3-552d-4b7c-8235-5a64da8524af","resolution":{"observed_at":"2026-08-07T11:03:31.369594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-09T23:55:28.902444Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback"},"reference_resolution":{"displayed":56,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":35,"verified_exact":0,"verified_fuzzy":21},"total_outbound_references":56},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 56 of 56 outbound references and 4 inbound Pith citation observations for arXiv:2506.04287."}