{"as_of":"2026-08-11T01:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:28e8dfce99b5a432fd498057019ff5a2064fa5b6950494071865544a0fd91206","coverage":[{"denominator":18,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T21:45:00.896630Z","state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-15T21:51:10.972744Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-15T21:51:40.816217Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.23667","last_updated":"2025-06-30T09:44:32Z","snapshot_observed_at":"2026-08-09T21:24:27.462179Z","submitted_at":"2025-06-30T09:44:32Z","title":"L0: Reinforcement Learning to Become General Agents","version":1},"cited_work":{"arxiv_id":"2506.23667","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.23667","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"L0: Reinforcement learning to become general agents","venue":null,"work_id":"388665da-4d0c-4789-93cd-be119432eff1","year":2025},"citing_paper":{"arxiv_id":"2603.16876","last_updated":"2026-05-08T08:14:14Z","snapshot_observed_at":"2026-08-08T17:32:30.075016Z","submitted_at":"2026-02-17T12:48:32Z","title":"Multi-Modal Multi-Agent Reinforcement Learning for Radiology Report Generation","version":2},"reference_index":140,"source":"pdf_text","source_observed_at":"2026-05-15T21:51:10.972744Z"},"links":{"cited_paper":"/paper/2506.23667","citing_paper":"/paper/2603.16876"},"observation_digest":"sha256:8c840e67fcdc604c6ee4132c36d6ceb600fb0540e0db301b526dacd6c6f95a7b","observation_id":"7f6b2a6f-fb70-41df-906c-053903ef2397","resolution":{"observed_at":"2026-05-15T21:51:40.820434Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23667","last_updated":"2025-06-30T09:44:32Z","snapshot_observed_at":"2026-08-09T21:24:27.462179Z","submitted_at":"2025-06-30T09:44:32Z","title":"L0: Reinforcement Learning to Become General Agents","version":1},"cited_work":{"arxiv_id":"2506.23667","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.23667","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"L0: Reinforcement learning to become general agents","venue":null,"work_id":"388665da-4d0c-4789-93cd-be119432eff1","year":2025},"citing_paper":{"arxiv_id":"2605.02913","last_updated":"2026-04-08T00:53:29Z","snapshot_observed_at":"2026-07-06T23:15:55.848885Z","submitted_at":"2026-04-08T00:53:29Z","title":"Generate, Filter, Control, Replay: A Comprehensive Survey of Rollout Strategies for LLM Reinforcement Learning","version":1},"reference_index":173,"source":"arxiv_source","source_observed_at":"2026-05-10T19:15:27.406778Z"},"links":{"cited_paper":"/paper/2506.23667","citing_paper":"/paper/2605.02913"},"observation_digest":"sha256:15bb7ef8a7c4d31a5ab10818c049b42ec616c50e25626826e4ce4ab7e355cbb7","observation_id":"1309c335-5c4e-4801-9ba6-78bcd1cdb231","resolution":{"observed_at":"2026-05-10T23:15:49.725122Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.23667/citation-record","integrity":"/paper/2506.23667/integrity","json":"/paper/2506.23667/citation-record.json","paper":"/paper/2506.23667"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.10978","last_updated":"2025-10-28T15:11:36Z","snapshot_observed_at":"2026-07-29T19:20:21.974239Z","submitted_at":"2025-05-16T08:26:59Z","title":"Group-in-Group Policy Optimization for LLM Agent Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.10978","snapshot_observed_at":"2026-08-06T21:44:59.706854Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23667","last_updated":"2025-06-30T09:44:32Z","snapshot_observed_at":"2026-08-09T21:24:27.462179Z","submitted_at":"2025-06-30T09:44:32Z","title":"L0: Reinforcement Learning to Become General Agents","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T21:44:59.706854Z"},"links":{"cited_paper":"/paper/2505.10978","citing_paper":"/paper/2506.23667"},"observation_digest":"sha256:a31fdf407936071d6094cee12573d8191ce950bc951164772e44014ecd880841","observation_id":"bef74cd5-63f2-434e-a12e-c43090396fe9","resolution":{"observed_at":"2026-08-06T21:44:59.706854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T21:44:59.778161Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23667","last_updated":"2025-06-30T09:44:32Z","snapshot_observed_at":"2026-08-09T21:24:27.462179Z","submitted_at":"2025-06-30T09:44:32Z","title":"L0: Reinforcement Learning to Become General Agents","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T21:44:59.778161Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.23667"},"observation_digest":"sha256:263a7fe7e2a86d326e666d55363172baba50fdcd3e610dfd6db72d51066c212b","observation_id":"8608f17b-f4a3-47d9-a94b-ba8cc8b87810","resolution":{"observed_at":"2026-08-06T21:44:59.778161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:02.704798Z","title":null,"venue":null,"work_id":"6f1e04a8-c8a3-410d-9b40-cb5749ecbee2","year":2020},"citing_paper":{"arxiv_id":"2506.23667","last_updated":"2025-06-30T09:44:32Z","snapshot_observed_at":"2026-08-09T21:24:27.462179Z","submitted_at":"2025-06-30T09:44:32Z","title":"L0: Reinforcement Learning to Become General Agents","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T21:44:59.884891Z"},"links":{"citing_paper":"/paper/2506.23667"},"observation_digest":"sha256:e457c2cc6982dd54a00fa56cbe51944d4638f2e5ba879f5a31944981eaa1300e","observation_id":"1ff586b0-bb82-4514-b5a2-ad612c94b987","resolution":{"observed_at":"2026-08-06T21:45:02.773356Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:02.488403Z","title":null,"venue":null,"work_id":"75d3fdd2-d575-4f8a-9198-5fc02a5cdc95","year":2025},"citing_paper":{"arxiv_id":"2506.23667","last_updated":"2025-06-30T09:44:32Z","snapshot_observed_at":"2026-08-09T21:24:27.462179Z","submitted_at":"2025-06-30T09:44:32Z","title":"L0: Reinforcement Learning to Become General Agents","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T21:44:59.933455Z"},"links":{"citing_paper":"/paper/2506.23667"},"observation_digest":"sha256:e5f0b4325fad3c9a08149b96efcd99d6d2ef2b9c502bd12f0d481ebe11359325","observation_id":"899f4bf4-0f05-44c5-bd4e-30cd78ef346f","resolution":{"observed_at":"2026-08-06T21:45:02.597391Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.07489","last_updated":"2024-09-13T08:26:23Z","snapshot_observed_at":"2026-08-08T16:24:57.574246Z","submitted_at":"2024-09-08T00:23:37Z","title":"RAGent: Retrieval-based Access Control Policy Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.07489","snapshot_observed_at":"2026-08-06T21:45:00.007761Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23667","last_updated":"2025-06-30T09:44:32Z","snapshot_observed_at":"2026-08-09T21:24:27.462179Z","submitted_at":"2025-06-30T09:44:32Z","title":"L0: Reinforcement Learning to Become General Agents","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:00.007761Z"},"links":{"cited_paper":"/paper/2409.07489","citing_paper":"/paper/2506.23667"},"observation_digest":"sha256:f136cbc5d6ba30a7ad80745decbb2d4de8698b1c1e6005aa7e4a90a85e8432b8","observation_id":"72fa6a89-92e5-439a-b933-439aa24f0a6a","resolution":{"observed_at":"2026-08-06T21:45:00.007761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09516","last_updated":"2025-08-05T19:08:38Z","snapshot_observed_at":"2026-07-06T20:51:28.022519Z","submitted_at":"2025-03-12T16:26:39Z","title":"Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09516","snapshot_observed_at":"2026-08-06T21:45:00.084961Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23667","last_updated":"2025-06-30T09:44:32Z","snapshot_observed_at":"2026-08-09T21:24:27.462179Z","submitted_at":"2025-06-30T09:44:32Z","title":"L0: Reinforcement Learning to Become General Agents","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:00.084961Z"},"links":{"cited_paper":"/paper/2503.09516","citing_paper":"/paper/2506.23667"},"observation_digest":"sha256:b852d3cd9dd6ec311428217f63032a129473fa56f09d30ed0f15200ca016bc29","observation_id":"7acf283a-68bb-4849-8f3f-ee404e39634e","resolution":{"observed_at":"2026-08-06T21:45:00.084961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:02.320359Z","title":null,"venue":null,"work_id":"93cfa09d-992d-4337-adcd-9c15a037c9c5","year":2017},"citing_paper":{"arxiv_id":"2506.23667","last_updated":"2025-06-30T09:44:32Z","snapshot_observed_at":"2026-08-09T21:24:27.462179Z","submitted_at":"2025-06-30T09:44:32Z","title":"L0: Reinforcement Learning to Become General Agents","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:00.190054Z"},"links":{"citing_paper":"/paper/2506.23667"},"observation_digest":"sha256:2581a689c8a6e076ce39251a652ff5403b6aae29f40d82b73511c85afde9e359","observation_id":"fa7a83f0-e58a-4379-86a5-f54943bd6301","resolution":{"observed_at":"2026-08-06T21:45:02.398920Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:02.181074Z","title":null,"venue":null,"work_id":"3e387cfa-ec4d-40ba-8af6-b6932d2a7f1a","year":2019},"citing_paper":{"arxiv_id":"2506.23667","last_updated":"2025-06-30T09:44:32Z","snapshot_observed_at":"2026-08-09T21:24:27.462179Z","submitted_at":"2025-06-30T09:44:32Z","title":"L0: Reinforcement Learning to Become General Agents","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:00.264906Z"},"links":{"citing_paper":"/paper/2506.23667"},"observation_digest":"sha256:32564ccfd19ba2ae0f7218b6434503a28e5e7475d12412fd685558340b0854bc","observation_id":"0371d9fe-77f0-4a83-8b55-39be7cf64e4a","resolution":{"observed_at":"2026-08-06T21:45:02.224600Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.05366","last_updated":"2025-01-09T16:48:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-09T16:48:17Z","title":"Search-o1: Agentic Search-Enhanced Large Reasoning Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.05366","snapshot_observed_at":"2026-08-06T21:45:00.349407Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23667","last_updated":"2025-06-30T09:44:32Z","snapshot_observed_at":"2026-08-09T21:24:27.462179Z","submitted_at":"2025-06-30T09:44:32Z","title":"L0: Reinforcement Learning to Become General Agents","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:00.349407Z"},"links":{"cited_paper":"/paper/2501.05366","citing_paper":"/paper/2506.23667"},"observation_digest":"sha256:ba37a56bf74d10429f7c2b4ac9764e1edd59b3743c1f7aae8523e99656a49336","observation_id":"9f9a0550-db7d-461b-b08a-5dabcfa900b1","resolution":{"observed_at":"2026-08-06T21:45:00.349407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:01.985287Z","title":null,"venue":null,"work_id":"1ef0f36f-b25d-49c7-82c1-3e3a838e7555","year":2023},"citing_paper":{"arxiv_id":"2506.23667","last_updated":"2025-06-30T09:44:32Z","snapshot_observed_at":"2026-08-09T21:24:27.462179Z","submitted_at":"2025-06-30T09:44:32Z","title":"L0: Reinforcement Learning to Become General Agents","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:00.408556Z"},"links":{"citing_paper":"/paper/2506.23667"},"observation_digest":"sha256:9530369f7f47201698ad3099444a34d6fdd33a1c6ddb9f2b3cc206100a183d60","observation_id":"8063a002-7b35-4e2b-bd16-40aca3581f7f","resolution":{"observed_at":"2026-08-06T21:45:02.072346Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.04588","last_updated":"2026-05-19T11:51:42Z","snapshot_observed_at":"2026-08-04T18:36:41.979541Z","submitted_at":"2025-05-07T17:30:22Z","title":"ZeroSearch: Incentivize the Search Capability of LLMs without Searching","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.04588","snapshot_observed_at":"2026-08-06T21:45:00.471283Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23667","last_updated":"2025-06-30T09:44:32Z","snapshot_observed_at":"2026-08-09T21:24:27.462179Z","submitted_at":"2025-06-30T09:44:32Z","title":"L0: Reinforcement Learning to Become General Agents","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:00.471283Z"},"links":{"cited_paper":"/paper/2505.04588","citing_paper":"/paper/2506.23667"},"observation_digest":"sha256:025692f344ef97e70c40aba8ed672d4d3057deaeb6b39a088347f3bfa1f18cf0","observation_id":"10349242-37f1-4f2e-b007-f0b20d7ab42a","resolution":{"observed_at":"2026-08-06T21:45:00.471283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:01.794077Z","title":null,"venue":null,"work_id":"713d6486-4ddb-429a-9c44-68ef2e21ba65","year":2022},"citing_paper":{"arxiv_id":"2506.23667","last_updated":"2025-06-30T09:44:32Z","snapshot_observed_at":"2026-08-09T21:24:27.462179Z","submitted_at":"2025-06-30T09:44:32Z","title":"L0: Reinforcement Learning to Become General Agents","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:00.537973Z"},"links":{"citing_paper":"/paper/2506.23667"},"observation_digest":"sha256:1f1c5e311787895a6a8ec9ea085a49e6b89f3ee91b07d0c67a1b959b31b7cab1","observation_id":"6394dd20-57cb-42e8-b990-3c0703ba3894","resolution":{"observed_at":"2026-08-06T21:45:01.893036Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:01.653696Z","title":null,"venue":null,"work_id":"a6131543-cd7e-4d6a-a67a-3746a6ff551f","year":2024},"citing_paper":{"arxiv_id":"2506.23667","last_updated":"2025-06-30T09:44:32Z","snapshot_observed_at":"2026-08-09T21:24:27.462179Z","submitted_at":"2025-06-30T09:44:32Z","title":"L0: Reinforcement Learning to Become General Agents","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:00.588082Z"},"links":{"citing_paper":"/paper/2506.23667"},"observation_digest":"sha256:3fc73f2de62bcdaec1e4e88df43ebb028ac23bceadf30cb524fccf16dc058212","observation_id":"b553d063-6f8b-41cf-a758-fb45b1b0bfd6","resolution":{"observed_at":"2026-08-06T21:45:01.720030Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:01.473067Z","title":null,"venue":null,"work_id":"fdb3f8c4-917b-4094-9807-9098f5038d28","year":2025},"citing_paper":{"arxiv_id":"2506.23667","last_updated":"2025-06-30T09:44:32Z","snapshot_observed_at":"2026-08-09T21:24:27.462179Z","submitted_at":"2025-06-30T09:44:32Z","title":"L0: Reinforcement Learning to Become General Agents","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:00.635927Z"},"links":{"citing_paper":"/paper/2506.23667"},"observation_digest":"sha256:bd4bf5fd9ae84559ea82febee344f7f82a00cdd66576abadcc48feadc4283dbc","observation_id":"f7fbddeb-c4cf-4e61-afac-b28e34b7a3a4","resolution":{"observed_at":"2026-08-06T21:45:01.551841Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04368","last_updated":"2024-11-07T01:58:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-11-07T01:58:42Z","title":"Measuring short-form factuality in large language models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04368","snapshot_observed_at":"2026-08-06T21:45:00.718465Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23667","last_updated":"2025-06-30T09:44:32Z","snapshot_observed_at":"2026-08-09T21:24:27.462179Z","submitted_at":"2025-06-30T09:44:32Z","title":"L0: Reinforcement Learning to Become General Agents","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:00.718465Z"},"links":{"cited_paper":"/paper/2411.04368","citing_paper":"/paper/2506.23667"},"observation_digest":"sha256:165283309c972ba8dfb3df8ee2ba7bd96fe67d3fb1d951a760a413cdc94570e7","observation_id":"e091268f-41eb-4008-bc86-6a39117b640e","resolution":{"observed_at":"2026-08-06T21:45:00.718465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-06T21:45:00.782069Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23667","last_updated":"2025-06-30T09:44:32Z","snapshot_observed_at":"2026-08-09T21:24:27.462179Z","submitted_at":"2025-06-30T09:44:32Z","title":"L0: Reinforcement Learning to Become General Agents","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:00.782069Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2506.23667"},"observation_digest":"sha256:7e1218b4e119d0f354e8815b93b166eb888878dcc5f0f85d874f01376221c4b6","observation_id":"8a587171-c7c8-4a4d-b714-114a72425a2e","resolution":{"observed_at":"2026-08-06T21:45:00.782069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:01.262894Z","title":null,"venue":null,"work_id":"ac03645f-58d6-4a04-9311-fbb51df1abbf","year":2018},"citing_paper":{"arxiv_id":"2506.23667","last_updated":"2025-06-30T09:44:32Z","snapshot_observed_at":"2026-08-09T21:24:27.462179Z","submitted_at":"2025-06-30T09:44:32Z","title":"L0: Reinforcement Learning to Become General Agents","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:00.834498Z"},"links":{"citing_paper":"/paper/2506.23667"},"observation_digest":"sha256:e98378262af864c7a8caa19de7d8cd351595626f2936c785238bfea0bef6cb0a","observation_id":"51f948a6-9df1-4632-a191-5819d4b31832","resolution":{"observed_at":"2026-08-06T21:45:01.382091Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:01.111597Z","title":null,"venue":null,"work_id":"e1b3a3d6-b8e1-47f0-b31e-7c8372500a37","year":2025},"citing_paper":{"arxiv_id":"2506.23667","last_updated":"2025-06-30T09:44:32Z","snapshot_observed_at":"2026-08-09T21:24:27.462179Z","submitted_at":"2025-06-30T09:44:32Z","title":"L0: Reinforcement Learning to Become General Agents","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:00.896630Z"},"links":{"citing_paper":"/paper/2506.23667"},"observation_digest":"sha256:d89801104e44fd0b01eb35257c7e3a1e97393be2a4bf8101596d0e144d3c4555","observation_id":"9caf3835-4d4d-403e-ba6c-4f0e747b91a4","resolution":{"observed_at":"2026-08-06T21:45:01.188222Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.23667","last_updated":"2025-06-30T09:44:32Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T21:24:27.462179Z","submitted_at":"2025-06-30T09:44:32Z","title":"L0: Reinforcement Learning to Become General Agents"},"reference_resolution":{"displayed":18,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":18},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 18 of 18 outbound references and 2 inbound Pith citation observations for arXiv:2506.23667."}