{"as_of":"2026-08-22T00:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:70fcb1a67dfacfb3b9338fe4ab698965831d8e1b84399001708a59c5b09c7274","coverage":[{"denominator":53,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":53,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:01:25.268734Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-16T09:33:30.444057Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-16T09:37:41.944603Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2505.22942","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.22942","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Yu Gu, Boyuan Zheng, Boyu Gou, Kai Zhang, Cheng Chang, Sanjari Srivastava, Yanan Xie, Peng Qi, Huan Sun, and Yu Su","venue":null,"work_id":"8efdd46e-289c-4d2e-99b0-d77572b48a7e","year":null},"citing_paper":{"arxiv_id":"2601.22149","last_updated":"2026-04-17T18:27:53Z","snapshot_observed_at":"2026-08-03T05:49:10.484175Z","submitted_at":"2026-01-29T18:59:07Z","title":"DynaWeb: Model-Based Reinforcement Learning of Web Agents","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-16T09:33:30.444057Z"},"links":{"cited_paper":"/paper/2505.22942","citing_paper":"/paper/2601.22149"},"observation_digest":"sha256:783da6ea527663d9c8f504d0f7ebc9bfdabccd120b73ece6f27934b7cedf2108","observation_id":"0c5f77f0-f1c3-468c-9463-1310ddc94d86","resolution":{"observed_at":"2026-05-16T09:37:41.946935Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.22942/citation-record","integrity":"/paper/2505.22942/integrity","json":"/paper/2505.22942/citation-record.json","paper":"/paper/2505.22942"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:20.246771Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:20.246771Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:df964d4670c3741e410ac7cba1dfc8ed4694bce324fdc30a68bc584d1022bebf","observation_id":"d6d3f758-f93f-4b9f-b296-2cfa105bc81d","resolution":{"observed_at":"2026-08-07T13:01:20.246771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:20.386292Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:20.386292Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:71b5e356e576b9724d35a5571f3fa18309b9f565abe7a9ae24e88c876a99f4bc","observation_id":"555dd279-badd-41eb-8dc7-0608c3a6e1a1","resolution":{"observed_at":"2026-08-07T13:01:20.386292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11704","last_updated":"2024-08-06T22:37:06Z","snapshot_observed_at":"2026-08-20T10:53:55.991490Z","submitted_at":"2024-06-17T16:25:04Z","title":"Nemotron-4 340B Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11704","snapshot_observed_at":"2026-08-07T13:01:20.532944Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:20.532944Z"},"links":{"cited_paper":"/paper/2406.11704","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:559cd5e9faac5b7e0861727ce9a76ad9d4095498bcf2d902ca1b932a4d523dc7","observation_id":"5c05b1af-4175-41d1-8cdf-042686b4f6e9","resolution":{"observed_at":"2026-08-07T13:01:20.532944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10935","last_updated":"2024-02-23T04:36:51Z","snapshot_observed_at":"2026-08-18T02:03:58.046358Z","submitted_at":"2024-01-17T08:10:35Z","title":"SeeClick: Harnessing GUI Grounding for Advanced Visual GUI Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10935","snapshot_observed_at":"2026-08-07T13:01:20.699288Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:20.699288Z"},"links":{"cited_paper":"/paper/2401.10935","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:9af0870f587c04b1f24031c550251c4ba1c19dbe979e3053884c128d9f87fff8","observation_id":"24c6ddbe-1b80-431a-a7c6-a1457d379561","resolution":{"observed_at":"2026-08-07T13:01:20.699288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05467","last_updated":"2025-02-28T16:02:27Z","snapshot_observed_at":"2026-08-19T21:46:54.851846Z","submitted_at":"2024-12-06T23:43:59Z","title":"The BrowserGym Ecosystem for Web Agent Research","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05467","snapshot_observed_at":"2026-08-07T13:01:20.809475Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:20.809475Z"},"links":{"cited_paper":"/paper/2412.05467","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:54faeec78d2f2fd6e92ea9f51f77cfb46f249b9a18cecf9fd260a23cf53e2cd3","observation_id":"073aff89-ce94-4cf9-a649-f8929e728b63","resolution":{"observed_at":"2026-08-07T13:01:20.809475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:28.150305Z","title":null,"venue":null,"work_id":"c814ae0a-39e6-42cb-bede-4c69c98d10a3","year":2023},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:20.888771Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:6beaa9c748ac0d32e66d4e2d689592d399c2ec312cdd2868c7e445e5d451fa65","observation_id":"9d04ee0b-94c0-4b75-9ba7-8a62058bd972","resolution":{"observed_at":"2026-08-07T13:01:28.232626Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:27.978515Z","title":"Laradji, Manuel Del Verme, Tom Marty, David Vazquez, Nicolas Chapados, and Alexandre Lacoste","venue":null,"work_id":"338c2462-7d9f-4924-b874-07c35afce7a0","year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:20.987141Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:a6c712cee7d9fa0d98eca7eac5a351a9d44f466dd9dc27f5afd7a1be45f4f2f2","observation_id":"4f3f1d3d-9b9b-4994-9aa0-26ef3b260ce3","resolution":{"observed_at":"2026-08-07T13:01:28.060460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T13:01:21.057274Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:21.057274Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:17f9df26b18dd7839fafe03c5a5ba42520dece3b012dac994c289040f57eeea8","observation_id":"0339ea42-1057-4d10-864d-f1d8e9ec2727","resolution":{"observed_at":"2026-08-07T13:01:21.057274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:27.812093Z","title":null,"venue":null,"work_id":"17a983f8-9f61-4e66-a08f-0e0efe4b1f4c","year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:21.126022Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:1fb796d86acfac5445011d7d7bee6acca8556d83d6ea831bc7c3b746c2073371","observation_id":"5d477bd3-3331-4e95-9d3d-2fbb01500ea4","resolution":{"observed_at":"2026-08-07T13:01:27.887314Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:21.198579Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:21.198579Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:ec1f93c1d1fb347bf0379e8a0f996d6d0dca11a58b9720952adb205ab9ad2dbd","observation_id":"24b2fc55-e79a-4c59-9716-f6d51fe25a70","resolution":{"observed_at":"2026-08-07T13:01:21.198579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T13:01:21.278424Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:21.278424Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:4fcc32d0fd312fee25009229f9a805bed29a5a65f52c7e15fec36d0e4e7255ff","observation_id":"83b894f4-da58-41bd-b9fd-b69d32ac0f09","resolution":{"observed_at":"2026-08-07T13:01:21.278424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.12856","last_updated":"2024-02-25T16:17:43Z","snapshot_observed_at":"2026-08-14T05:33:25.547274Z","submitted_at":"2023-07-24T14:56:30Z","title":"A Real-World WebAgent with Planning, Long Context Understanding, and Program Synthesis","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.12856","snapshot_observed_at":"2026-08-07T13:01:21.382104Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:21.382104Z"},"links":{"cited_paper":"/paper/2307.12856","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:9d9367825ca1938c8aa64dd2877923e209380473e76637d49b1a5d61ffd2fbd0","observation_id":"68a133eb-d901-42e3-9210-9afdc67ce733","resolution":{"observed_at":"2026-08-07T13:01:21.382104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13919","last_updated":"2024-06-06T18:37:34Z","snapshot_observed_at":"2026-08-15T01:23:25.524198Z","submitted_at":"2024-01-25T03:33:18Z","title":"WebVoyager: Building an End-to-End Web Agent with Large Multimodal Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13919","snapshot_observed_at":"2026-08-07T13:01:21.513024Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:21.513024Z"},"links":{"cited_paper":"/paper/2401.13919","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:f83fd0aeaabd9a0d110b59932ed7511fa5438032090b41bf14104982d3a40a83","observation_id":"b17aeedb-adc1-4c61-b128-beb80f898367","resolution":{"observed_at":"2026-08-07T13:01:21.513024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.19609","last_updated":"2024-10-25T15:01:27Z","snapshot_observed_at":"2026-08-16T13:05:55.573985Z","submitted_at":"2024-10-25T15:01:27Z","title":"OpenWebVoyager: Building Multimodal Web Agents via Iterative Real-World Exploration, Feedback and Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.19609","snapshot_observed_at":"2026-08-07T13:01:21.608317Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:21.608317Z"},"links":{"cited_paper":"/paper/2410.19609","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:d0aba6ec77c19e70c6777a07008efa4e0d50332573bc9974d328531d2e04eaf3","observation_id":"60e58c5d-6d0d-4c86-bada-cbe80b64a804","resolution":{"observed_at":"2026-08-07T13:01:21.608317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-08-15T14:02:47.366139Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T13:01:21.704241Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:21.704241Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:0aba6db45b489ecb0c0c6c67fd5e77ee1ccf224ac96f12b06edb93cc1de7dfff","observation_id":"337f8532-e1f3-4e5b-86e5-2c897efd69c0","resolution":{"observed_at":"2026-08-07T13:01:21.704241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.19100","last_updated":"2025-02-15T05:19:38Z","snapshot_observed_at":"2026-08-16T13:06:08.749105Z","submitted_at":"2024-10-24T19:03:01Z","title":"VideoWebArena: Evaluating Long Context Multimodal Agents with Video Understanding Web Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.19100","snapshot_observed_at":"2026-08-07T13:01:21.774280Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:21.774280Z"},"links":{"cited_paper":"/paper/2410.19100","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:a04099a37c4bfb92928042071e6b874cbe11a1d7a69dece689e7e2c68038cf28","observation_id":"233fcc62-c834-4818-b132-b3642fa84a08","resolution":{"observed_at":"2026-08-07T13:01:21.774280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:27.632351Z","title":null,"venue":null,"work_id":"9d3bc326-27bf-4d22-b1b6-bc1c03fb50cc","year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:21.867543Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:5dca7cae8c50ea55ebf01b095cefe2d0a72379467d1aec8072029b42fcf077e7","observation_id":"18091e6e-8d27-4e9c-8127-a67f3eceb49c","resolution":{"observed_at":"2026-08-07T13:01:27.722297Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:27.454551Z","title":null,"venue":null,"work_id":"4940f82b-ffda-47e1-9cd0-0445cf219cdb","year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:21.945890Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:cd166952cfb315844109246ddef14191c39272f393629923ef8875951748002c","observation_id":"bddcc80b-d7c3-4d49-969a-4b5a4bd78c04","resolution":{"observed_at":"2026-08-07T13:01:27.545256Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06703","last_updated":"2026-06-04T09:59:28Z","snapshot_observed_at":"2026-08-16T13:11:11.539278Z","submitted_at":"2024-10-09T09:13:38Z","title":"ST-WebAgentBench: A Benchmark for Evaluating Safety and Trustworthiness in Web Agents","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06703","snapshot_observed_at":"2026-08-07T13:01:22.017252Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:22.017252Z"},"links":{"cited_paper":"/paper/2410.06703","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:82886ffe65e275f3115be9f3fdecacf3dee563fd14398d9b3d67fc7c2360616b","observation_id":"ee25ebe5-b132-47da-b113-31e06bc30f82","resolution":{"observed_at":"2026-08-07T13:01:22.017252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:22.120072Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:22.120072Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:667ac9710981885b288ef108ff8e058863ba2661b7b382c7221e67b744136d62","observation_id":"6658e12c-bddd-42d5-8bbc-633daa5d0b52","resolution":{"observed_at":"2026-08-07T13:01:22.120072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17657","last_updated":"2025-06-16T06:25:31Z","snapshot_observed_at":"2026-08-17T12:59:11.518099Z","submitted_at":"2024-10-23T08:19:18Z","title":"ReflecTool: Towards Reflection-Aware Tool-Augmented Clinical Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.17657","snapshot_observed_at":"2026-08-07T13:01:22.236158Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:22.236158Z"},"links":{"cited_paper":"/paper/2410.17657","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:7d954e2ceee2f75cd306093a27a6a78fedd0a0756eb0518102f808135eb6ae66","observation_id":"7c90a064-4a20-49b5-83b6-be24acdb7b0b","resolution":{"observed_at":"2026-08-07T13:01:22.236158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03688","last_updated":"2025-10-04T03:54:18Z","snapshot_observed_at":"2026-08-20T10:21:12.032735Z","submitted_at":"2023-08-07T16:08:11Z","title":"AgentBench: Evaluating LLMs as Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03688","snapshot_observed_at":"2026-08-07T13:01:22.351667Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:22.351667Z"},"links":{"cited_paper":"/paper/2308.03688","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:7e791fceb8309ef88f51d295840e959c2206c3eca49178117b7264bf76ccd8fb","observation_id":"c5e43736-43ad-4bde-a342-009c3178061d","resolution":{"observed_at":"2026-08-07T13:01:22.351667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08172","last_updated":"2024-02-21T17:42:32Z","snapshot_observed_at":"2026-08-17T01:24:33.822975Z","submitted_at":"2023-09-15T05:44:08Z","title":"LASER: LLM Agent with State-Space Exploration for Web Navigation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.08172","snapshot_observed_at":"2026-08-07T13:01:22.457080Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:22.457080Z"},"links":{"cited_paper":"/paper/2309.08172","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:94e6a06edbc2adf4c3f0789c3ff8ff29418937e2c4bdc73b160e90ba65b81508","observation_id":"0fa1ecbc-8652-4784-99a3-ed2dbcd2078e","resolution":{"observed_at":"2026-08-07T13:01:22.457080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:22.596124Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:22.596124Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:e66dbff4ede81528dbbd8b304eea8c6384aeecf3e036ff7f3d3579ece77b45e2","observation_id":"67007de0-b117-4a67-a764-1da794453828","resolution":{"observed_at":"2026-08-07T13:01:22.596124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19393","last_updated":"2025-03-01T06:07:39Z","snapshot_observed_at":"2026-08-17T11:00:39.333660Z","submitted_at":"2025-01-31T18:48:08Z","title":"s1: Simple test-time scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19393","snapshot_observed_at":"2026-08-07T13:01:22.713507Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:22.713507Z"},"links":{"cited_paper":"/paper/2501.19393","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:55b6cd68f691f5ab17d67003bd8b3ba58af6ac5a6e5bf0bac8797060951c9f2f","observation_id":"9b518536-05fb-4fb4-aae4-9fa037557982","resolution":{"observed_at":"2026-08-07T13:01:22.713507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.09332","last_updated":"2022-06-01T19:08:11Z","snapshot_observed_at":"2026-08-19T02:54:55.334346Z","submitted_at":"2021-12-17T05:43:43Z","title":"WebGPT: Browser-assisted question-answering with human feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.09332","snapshot_observed_at":"2026-08-07T13:01:22.826852Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:22.826852Z"},"links":{"cited_paper":"/paper/2112.09332","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:841d7d5b926d54b1cd40a1ccb2ae825fb7e51f8a942b7725d359985b99dd7e68","observation_id":"83a9e7f2-1d7f-4b33-96f3-481373a19201","resolution":{"observed_at":"2026-08-07T13:01:22.826852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:27.315333Z","title":null,"venue":null,"work_id":"7518b93e-3f8d-494b-b7ca-048d65e93313","year":2025},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:22.893349Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:8748b14e3fb779678749f9b4b2274dd68b49e0a71430bd16319dd730d12451d1","observation_id":"f4825587-3a7f-4bc0-976e-06fd526f37c9","resolution":{"observed_at":"2026-08-07T13:01:27.380947Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:27.134890Z","title":null,"venue":null,"work_id":"fc3ce86b-6a8d-4ee1-99ce-5bc8e5c3f951","year":2025},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:22.989790Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:21f8727e3ff97702ddfe93c63834e432da25acb189148bc54e33612e7d3e7365","observation_id":"12d7c553-52f3-46d0-81d4-e8ea9dafa983","resolution":{"observed_at":"2026-08-07T13:01:27.223706Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:26.932976Z","title":null,"venue":null,"work_id":"99b26fa6-e861-4118-b367-3fdebfdfb6a5","year":2025},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:23.100271Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:6bf96849cf9175a27f1984b0f673c42872177a5a56f8539c2b941cad72cd07b4","observation_id":"945135ee-9b28-4163-86b4-0b92a3c8fe41","resolution":{"observed_at":"2026-08-07T13:01:27.023101Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06474","last_updated":"2024-10-07T14:19:37Z","snapshot_observed_at":"2026-08-17T23:01:45.590632Z","submitted_at":"2024-04-09T17:25:47Z","title":"Autonomous Evaluation and Refinement of Digital Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.06474","snapshot_observed_at":"2026-08-07T13:01:23.261317Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:23.261317Z"},"links":{"cited_paper":"/paper/2404.06474","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:36292eea6291e3257c310804993b8140d581109996f32566369cc7569c492aef","observation_id":"0d76ac06-0f6b-468c-9f6c-137e27ee6005","resolution":{"observed_at":"2026-08-07T13:01:23.261317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12373","last_updated":"2024-07-16T06:19:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-18T07:58:33Z","title":"WebCanvas: Benchmarking Web Agents in Online Environments","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12373","snapshot_observed_at":"2026-08-07T13:01:23.366902Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:23.366902Z"},"links":{"cited_paper":"/paper/2406.12373","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:4dbfb90e13e0b59d2ad4b9a9771f75e0f928beecea02f1fc75dd736dc77fd160","observation_id":"63dfd185-4092-4c15-997a-74ee35241cf1","resolution":{"observed_at":"2026-08-07T13:01:23.366902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:26.784929Z","title":null,"venue":null,"work_id":"a38f2317-12b6-4bfa-9706-da56ae59a0e7","year":2025},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:23.452456Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:0f27e84a12fca80f44074b0cef400fcd8920afdbe1636bfe7a8ac72ff85aa9ba","observation_id":"da49da50-7f77-48e0-8e68-bb3df4780cf2","resolution":{"observed_at":"2026-08-07T13:01:26.840084Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13958","last_updated":"2025-04-16T21:45:32Z","snapshot_observed_at":"2026-08-15T04:58:53.543603Z","submitted_at":"2025-04-16T21:45:32Z","title":"ToolRL: Reward is All Tool Learning Needs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.13958","snapshot_observed_at":"2026-08-07T13:01:23.554145Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:23.554145Z"},"links":{"cited_paper":"/paper/2504.13958","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:27187eeea848fb2d164310459f3666bb1c7da0586be9daf8a6525ccca072fe5b","observation_id":"dbc72f20-ca55-4d15-af67-e673b2f1ff4f","resolution":{"observed_at":"2026-08-07T13:01:23.554145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:26.617053Z","title":null,"venue":null,"work_id":"5e1955fe-9c56-41af-b797-279004f1426b","year":2025},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:23.664870Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:00b343e674087170f3acf0c707f4bb704795ea78bf52bc28d3ce63a07482796d","observation_id":"72453d07-1e30-4f0e-8792-46d2b5fe212c","resolution":{"observed_at":"2026-08-07T13:01:26.699032Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T13:01:23.720922Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:23.720922Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:ae75c68d4225cd8f89b4d94bf4e0654fb11d7daafe63ec1b2142fcc2699b2c77","observation_id":"c73efc34-93f3-4204-b6af-ed3bbdee65c8","resolution":{"observed_at":"2026-08-07T13:01:23.720922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19256","last_updated":"2024-10-02T04:01:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-28T06:20:03Z","title":"HybridFlow: A Flexible and Efficient RLHF Framework","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.19256","snapshot_observed_at":"2026-08-07T13:01:23.800865Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:23.800865Z"},"links":{"cited_paper":"/paper/2409.19256","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:1b4fe759db1c678f271919580ca0ad04ace3724beed379f5e772eded24eec9b3","observation_id":"46d2388d-2d3d-4ce4-bd7b-cc6325a520cb","resolution":{"observed_at":"2026-08-07T13:01:23.800865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03314","snapshot_observed_at":"2026-08-07T13:01:23.909056Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:23.909056Z"},"links":{"cited_paper":"/paper/2408.03314","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:ff09d7aef2b5a51584897af5118d423cf91ef1d94227237c4d94b04f8968ac73","observation_id":"02dc13a4-91d7-46d5-aa79-4997c9059013","resolution":{"observed_at":"2026-08-07T13:01:23.909056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:23.985552Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:23.985552Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:46f70d944621a0fa8f6f8969f7297978e56a10f9bc3380b6f944c863b85a75b5","observation_id":"6cf7d8cc-a877-4e04-95a5-beb079905529","resolution":{"observed_at":"2026-08-07T13:01:23.985552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:26.405475Z","title":null,"venue":null,"work_id":"d7f889c1-bb9a-4a70-9dd4-fcd3d149f4c7","year":2023},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:24.088216Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:80a8e880d94dffb4544b1e07f8c635014a5faa3c82e0d1d5b7ae89db623a9d79","observation_id":"6f9d5973-3f37-4027-99f3-391fb6525e4c","resolution":{"observed_at":"2026-08-07T13:01:26.512551Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:26.265363Z","title":null,"venue":null,"work_id":"37d0936e-ce61-43fb-8a61-37633c9e66a1","year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:24.193795Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:1c38a3a67e135a60dd903b0faf35fdc8237be1c902d4ab93adc8364d349866e9","observation_id":"3afd9b5f-3988-417f-bb44-1cd1a5b200a8","resolution":{"observed_at":"2026-08-07T13:01:26.316314Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:24.249896Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:24.249896Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:0acb2e4a6356565e4283a40ecc4c291f497284416694dd7a74d224b3f98bba2f","observation_id":"8e3605c6-8824-497f-b3e2-91711b2ce922","resolution":{"observed_at":"2026-08-07T13:01:24.249896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.20073","last_updated":"2025-05-26T17:19:30Z","snapshot_observed_at":"2026-08-13T08:41:26.093022Z","submitted_at":"2025-04-24T17:57:08Z","title":"RAGEN: Understanding Self-Evolution in LLM Agents via Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.20073","snapshot_observed_at":"2026-08-07T13:01:24.323615Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:24.323615Z"},"links":{"cited_paper":"/paper/2504.20073","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:4a945c321e7fa6779f63a2cbd42930c4d89a437a1547a66764aead81ebfd318e","observation_id":"1973b9e9-7deb-4ffe-9ccf-5fb05d9dcecd","resolution":{"observed_at":"2026-08-07T13:01:24.323615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14161","last_updated":"2025-09-10T08:35:19Z","snapshot_observed_at":"2026-08-16T19:31:08.289292Z","submitted_at":"2024-12-18T18:55:40Z","title":"TheAgentCompany: Benchmarking LLM Agents on Consequential Real World Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14161","snapshot_observed_at":"2026-08-07T13:01:24.423383Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:24.423383Z"},"links":{"cited_paper":"/paper/2412.14161","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:fb80579d62c09cf9195176480ae31ebe8f8af58c23ffa308f85dc9a318e1633d","observation_id":"47af6178-9d8f-4070-8a8d-64b8fe54ba03","resolution":{"observed_at":"2026-08-07T13:01:24.423383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-08-17T18:50:07.059564Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T13:01:24.515562Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:24.515562Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:a2acf0d61e12baf85c4f7bdb6df89b90a4ab8fe267a3401dfc592d720bebca7a","observation_id":"148e3680-84c5-44c1-aba5-a5839a598083","resolution":{"observed_at":"2026-08-07T13:01:24.515562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:24.584038Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:24.584038Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:1ca59f80f311f6759bf5dddd0057a2267197a2a4f98679de5f72ec0f974c776d","observation_id":"70230196-de45-4987-ba2e-0feb2d3e5680","resolution":{"observed_at":"2026-08-07T13:01:24.584038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:24.656432Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:24.656432Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:44ea24347c774a68e9d65e97ab8b5d449ad44bb61166d7195fba177ee097fe34","observation_id":"cbafc01e-53ce-4ff1-b7c3-a0d2912c1ecd","resolution":{"observed_at":"2026-08-07T13:01:24.656432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:24.740668Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:24.740668Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:3dc91a049b456827170178cc0fa5fb88eec166d8c6681d83afe71ab8bf13ac1d","observation_id":"c435f826-8d81-4429-85f1-58a81941880e","resolution":{"observed_at":"2026-08-07T13:01:24.740668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15711","last_updated":"2024-10-21T15:45:31Z","snapshot_observed_at":"2026-08-20T13:32:31.568284Z","submitted_at":"2024-07-22T15:18:45Z","title":"AssistantBench: Can Web Agents Solve Realistic and Time-Consuming Tasks?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.15711","snapshot_observed_at":"2026-08-07T13:01:24.836115Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:24.836115Z"},"links":{"cited_paper":"/paper/2407.15711","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:8423e6c0113e2fd1fa6a282d2ce7e53e3ad961c5139f636cf04c90803e6c247f","observation_id":"76fe97b0-2dcd-4329-a6e2-899f652b19cf","resolution":{"observed_at":"2026-08-07T13:01:24.836115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01614","last_updated":"2024-03-12T23:14:33Z","snapshot_observed_at":"2026-08-13T20:16:41.272728Z","submitted_at":"2024-01-03T08:33:09Z","title":"GPT-4V(ision) is a Generalist Web Agent, if Grounded","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.01614","snapshot_observed_at":"2026-08-07T13:01:24.921010Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:24.921010Z"},"links":{"cited_paper":"/paper/2401.01614","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:44c2fd6a64f823074720c3bcf1aa44ac85a51dd92c9cc2c9d30c47591f6eb468","observation_id":"a9d98500-5871-425b-8269-0adb0b2176f0","resolution":{"observed_at":"2026-08-07T13:01:24.921010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13854","last_updated":"2024-04-16T15:13:18Z","snapshot_observed_at":"2026-08-14T11:14:55.351653Z","submitted_at":"2023-07-25T22:59:32Z","title":"WebArena: A Realistic Web Environment for Building Autonomous Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13854","snapshot_observed_at":"2026-08-07T13:01:25.009096Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:25.009096Z"},"links":{"cited_paper":"/paper/2307.13854","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:5b447f9c926489d0f33482c6542e9d4a9e6ebf066199f46c5dffc8bbaa2e40e1","observation_id":"d1f95386-dd9e-4eb1-a2a0-bc0118ab9296","resolution":{"observed_at":"2026-08-07T13:01:25.009096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:26.043270Z","title":"Rossi, Somdeb Sarkhel, and Chao Zhang","venue":null,"work_id":"e6226967-3ad0-4ab2-be1b-951b571e5ff0","year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:25.083595Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:f974cfe9c9acd58f30ffbdca91a44b76cc9813d72e4f5a51c0b42e12bf267f91","observation_id":"d7b712e4-e754-4120-836e-84c908bc680b","resolution":{"observed_at":"2026-08-07T13:01:26.145194Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:01:25.874862Z","title":null,"venue":null,"work_id":"a0faedad-9695-4a45-9796-735122b4999c","year":2024},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:25.203793Z"},"links":{"citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:ce57209dbd0b633407d59a69afe572d081b16bfc49037cbe98b47c72633776e5","observation_id":"65f17232-ffc7-4b7c-8295-3501c40d7130","resolution":{"observed_at":"2026-08-07T13:01:25.939759Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06589","last_updated":"2025-02-10T15:54:34Z","snapshot_observed_at":"2026-08-19T08:02:57.204883Z","submitted_at":"2025-02-10T15:54:34Z","title":"Hephaestus: Improving Fundamental Agent Capabilities of Large Language Models through Continual Pre-Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06589","snapshot_observed_at":"2026-08-07T13:01:25.268734Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T13:01:25.268734Z"},"links":{"cited_paper":"/paper/2502.06589","citing_paper":"/paper/2505.22942"},"observation_digest":"sha256:72c17fbb14ad8689234938c4ef11e3555abb79edaf47339b17b73dbebcea49f0","observation_id":"99e6c23d-c187-416f-b266-476e79738164","resolution":{"observed_at":"2026-08-07T13:01:25.268734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.22942","last_updated":"2025-06-08T07:57:08Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-17T17:19:56.010591Z","submitted_at":"2025-05-28T23:45:28Z","title":"WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning"},"reference_resolution":{"displayed":53,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":51,"verified_exact":0,"verified_fuzzy":2},"total_outbound_references":53},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 53 of 53 outbound references and 1 inbound Pith citation observation for arXiv:2505.22942."}