{"as_of":"2026-08-09T14:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c2f310b5dcee73df7d95fd1a94f7d8daf8912f059425bc6010ff8c79f88597a4","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T00:49:50.173686Z","state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.03571/citation-record","integrity":"/paper/2608.03571/integrity","json":"/paper/2608.03571/citation-record.json","paper":"/paper/2608.03571"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:49:50.143215Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-09T14:10:07.509219Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.143215Z"},"links":{"citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:14a098b6575247fb61a08b20a85ce3e95412fc327fefdc1322daec98f78d6546","observation_id":"6011476f-fa79-4241-9f11-fe37a17017ac","resolution":{"observed_at":"2026-08-08T00:49:50.143215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:49:50.147095Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-09T14:10:07.509219Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.147095Z"},"links":{"citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:ac35e7fcf80dda78dc0616cd76f703eeefa7a0b624e7ae9a03e22d104890071c","observation_id":"5fc581b8-0c76-43b4-9a87-9a3596a4dc42","resolution":{"observed_at":"2026-08-08T00:49:50.147095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.00347","last_updated":"2026-05-01T02:05:56Z","snapshot_observed_at":"2026-07-06T23:13:47.082550Z","submitted_at":"2026-05-01T02:05:56Z","title":"Odysseus: Scaling VLMs to 100+ Turn Decision-Making in Games via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.00347","snapshot_observed_at":"2026-08-08T00:49:50.099166Z","title":"Xiaoshuai Song, Haofei Chang, Guanting Dong, Yutao Zhu, Zhicheng Dou, and Ji-Rong Wen","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-09T14:10:07.509219Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.099166Z"},"links":{"cited_paper":"/paper/2605.00347","citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:0653fa9b18dd07313401f14501d6c69577a7aafac47d7fd1dabcf7df28173106","observation_id":"72f2291e-4f9f-4c72-a4a4-f838637c2d23","resolution":{"observed_at":"2026-08-08T00:49:50.099166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05726","last_updated":"2025-02-08T23:59:41Z","snapshot_observed_at":"2026-08-08T18:10:40.739393Z","submitted_at":"2025-02-08T23:59:41Z","title":"Improving Environment Novelty Quantification for Effective Unsupervised Environment Design","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05726","snapshot_observed_at":"2026-08-08T00:49:50.102398Z","title":"Preprint, arXiv:2502.05726","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-09T14:10:07.509219Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.102398Z"},"links":{"cited_paper":"/paper/2502.05726","citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:097034525cad2faf2500db1206311d6173af15fbe7b62895c1dcb09fd1fb37aa","observation_id":"76755303-a8f4-4c03-9562-bcd6fd5a439a","resolution":{"observed_at":"2026-08-08T00:49:50.102398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.21798","last_updated":"2025-05-21T17:21:45Z","snapshot_observed_at":"2026-07-06T21:17:09.837496Z","submitted_at":"2025-04-30T16:56:06Z","title":"SWE-smith: Scaling Data for Software Engineering Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.21798","snapshot_observed_at":"2026-08-08T00:49:50.106422Z","title":"John Yang, Akshara Prabhakar, Karthik Narasimhan, and Shunyu Yao","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-09T14:10:07.509219Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.106422Z"},"links":{"cited_paper":"/paper/2504.21798","citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:f2af5b10909712029ebf596964f6ec02ccab7e726651261880dc74bdddfff7fe","observation_id":"3c503544-e35d-4636-bd2e-216cb4ee58c7","resolution":{"observed_at":"2026-08-08T00:49:50.106422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:49:50.173686Z","title":"Return exactly one valid JSON object only","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-09T14:10:07.509219Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.173686Z"},"links":{"citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:e2b2824f916412d78cf83610b36962971f9eb843a8d15802f05ca6cfa9bd74b1","observation_id":"0eb1c13b-7dd3-43a9-bc72-3d9a2dc2245a","resolution":{"observed_at":"2026-08-08T00:49:50.173686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.07317","last_updated":"2026-06-06T19:45:56Z","snapshot_observed_at":"2026-08-03T23:08:02.092548Z","submitted_at":"2025-11-10T17:18:35Z","title":"RLVE: Scaling Up Reinforcement Learning for Language Models with Adaptive Verifiable Environments","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.07317","snapshot_observed_at":"2026-08-08T00:49:50.113959Z","title":"Dazhi Zhan, Xin Liu, Wei Bai, Wei Li, Shize Guo, and Zhisong Pan","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-09T14:10:07.509219Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.113959Z"},"links":{"cited_paper":"/paper/2511.07317","citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:7bdbfe6660956c03051e29279859b828a0d4380d1efee4cfdb9f4054cc6c60f4","observation_id":"79dbd851-04f6-4497-971d-815a2b4a0b7b","resolution":{"observed_at":"2026-08-08T00:49:50.113959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:49:50.562877Z","title":"ADCL (Zhang et al., 2025a) periodically re-estimates sample difficulty to mitigate difficulty shift during training","venue":null,"work_id":"2a4e303f-3b42-485e-b545-657dadc7322f","year":2025},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-09T14:10:07.509219Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.121134Z"},"links":{"citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:5aa506da16186bd473bd132296d2fdd83a9728bf22cedb44ea43e7146db314b3","observation_id":"7fc91c40-0a3f-47a0-8171-bbb119c4ff5f","resolution":{"observed_at":"2026-08-08T00:49:50.566686Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:49:50.551085Z","title":"In the main experiments, we further include Qwen3-VL-8B- Instruct to evaluate whether our method remains effective with a larger model","venue":null,"work_id":"89c8813d-c993-4741-b2a5-ab00d7d1ca8c","year":null},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-09T14:10:07.509219Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.124677Z"},"links":{"citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:926233d0fcaa5916d0f646e3d1bb8682f4cad75b825d70df7797b7be1015b3bb","observation_id":"cb74b442-407e-4415-8ca5-e9f055bf1e39","resolution":{"observed_at":"2026-08-08T00:49:50.555394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:49:50.539608Z","title":"Specifically, all runs use the same total number of training samples, which is set to 7,680 in our experiments","venue":null,"work_id":"3015445b-0b06-4ba6-a966-b7ab1e194e8a","year":2025},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-09T14:10:07.509219Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.127773Z"},"links":{"citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:33cd9928235b5e1c7c16132411a27c9323eddcdea18e43f429e9f22b65149a21","observation_id":"af2d5206-b856-4c6d-bd09-e47fa04c906f","resolution":{"observed_at":"2026-08-08T00:49:50.543858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:49:50.526982Z","title":"impossible","venue":null,"work_id":"1e6a35ca-e220-4ac9-a03a-527528fc54a2","year":2024},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-09T14:10:07.509219Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.131825Z"},"links":{"citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:4da92bd652ccecc3ddf58ce875ca111e3d396bf5edfa1cb5cd2b185715b4d7e7","observation_id":"87f04dbe-1e7a-47d0-8fd8-b96d3b24fefd","resolution":{"observed_at":"2026-08-08T00:49:50.531740Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:49:50.135414Z","title":"All methods use the same AES-selected environment subset and the same total training budget","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-09T14:10:07.509219Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.135414Z"},"links":{"citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:1430554928073f1b44b7aab1d7df4d69378d494d14e098b3e9409c4044685eb2","observation_id":"12cc483b-b170-433f-8d60-2eff8c6cca3f","resolution":{"observed_at":"2026-08-08T00:49:50.135414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:49:50.138802Z","title":"The curve shows an adaptive learning process","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-09T14:10:07.509219Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.138802Z"},"links":{"citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:21a03932cdd7c092efd87a67bc63631e8d7580b9d8e5a0804082f26954857184","observation_id":"e926f70c-cfff-4914-b742-248d8a61766d","resolution":{"observed_at":"2026-08-08T00:49:50.138802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:49:50.149745Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-09T14:10:07.509219Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.149745Z"},"links":{"citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:2fc18f918ff6dd3dfd88858969e291131871990890da21dcdc2e486e43401f51","observation_id":"261a7b67-5dcd-4b0a-9a05-69c310037036","resolution":{"observed_at":"2026-08-08T00:49:50.149745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:49:50.152733Z","title":"A rollout step is one interaction with the environment","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-09T14:10:07.509219Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.152733Z"},"links":{"citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:641b017d501e1519c47d57021bf626501f56dcf1e73c5fd6338d2c64a46f37b6","observation_id":"eb1b9621-4807-4755-a2eb-6c9bce8823a2","resolution":{"observed_at":"2026-08-08T00:49:50.152733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:49:50.156496Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-09T14:10:07.509219Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.156496Z"},"links":{"citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:ee3a750bdfa54c3bf3a5b30eee0d6bb181bc4b51f6e8691153df1335402525e7","observation_id":"fa31ced4-4384-4ba1-8cc2-1720feb8328d","resolution":{"observed_at":"2026-08-08T00:49:50.156496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:49:50.159705Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-09T14:10:07.509219Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.159705Z"},"links":{"citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:e3c9aa09a4b5ac599e9819f449f813f35bfc9a52b2c2f0a1b66f3d96390cee84","observation_id":"f4442c71-0116-45a3-8493-c673e069f2e7","resolution":{"observed_at":"2026-08-08T00:49:50.159705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:49:50.163838Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-09T14:10:07.509219Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.163838Z"},"links":{"citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:496c6b9a943cdcacdf9219983b1daa411921794ab7f7cbc649b5339a845972bd","observation_id":"ef1e454d-28b7-4b94-9f55-2b3846399696","resolution":{"observed_at":"2026-08-08T00:49:50.163838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:49:50.166610Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-09T14:10:07.509219Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.166610Z"},"links":{"citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:c65d8ae6348dfb036af9279c1deba6b3de3b425896e46c8b0df487c7b5bd6bc6","observation_id":"5a55c1fe-2bfe-4ff2-863d-e869f93c0b91","resolution":{"observed_at":"2026-08-08T00:49:50.166610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:49:50.169734Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-09T14:10:07.509219Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.169734Z"},"links":{"citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:00f23f2aeab817393bdb141cf9be5a9a6c1e5372b1e4103ede6083413c08ad9d","observation_id":"4e72fb79-a5f5-40dc-8690-7868f6d2dadb","resolution":{"observed_at":"2026-08-08T00:49:50.169734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04141","last_updated":"2026-07-20T11:08:55Z","snapshot_observed_at":"2026-08-08T00:41:56.834898Z","submitted_at":"2025-06-04T16:33:41Z","title":"MMR-V: What's Left Unsaid? A Benchmark for Multimodal Deep Reasoning in Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.04141","snapshot_observed_at":"2026-08-08T00:49:50.117587Z","title":"Kejian Zhu, Zhuoran Jin, Hongbang Yuan, Jiachun Li, Shangqing Tu, Pengfei Cao, Yubo Chen, Kang Liu, and Jun Zhao","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-09T14:10:07.509219Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.117587Z"},"links":{"cited_paper":"/paper/2506.04141","citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:1cf6f52a4e1a897536e319102d230f0117db930299d5e66107e44c3e679e38ba","observation_id":"fc22239d-0da1-49c1-b065-5cfddb0ec259","resolution":{"observed_at":"2026-08-08T00:49:50.117587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02722","last_updated":"2025-09-06T21:02:02Z","snapshot_observed_at":"2026-08-06T16:33:27.369886Z","submitted_at":"2025-09-02T18:18:57Z","title":"Planning with Reasoning using Vision Language World Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.02722","snapshot_observed_at":"2026-08-08T00:49:50.095503Z","title":"Jianlv Chen, Shitao Xiao, Peitian Zhang, Kun Luo, Defu Lian, and Zheng Liu","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-09T14:10:07.509219Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.095503Z"},"links":{"cited_paper":"/paper/2509.02722","citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:f7ffb1191a9fd1f4d61904906ed1ca0afdf39138f339fcc64bd679c483ccc02e","observation_id":"33342f5c-3494-4700-9838-5c6adfbc55eb","resolution":{"observed_at":"2026-08-08T00:49:50.095503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.06126","last_updated":"2026-04-07T17:38:15Z","snapshot_observed_at":"2026-07-06T22:54:40.349479Z","submitted_at":"2026-04-07T17:38:15Z","title":"Gym-Anything: Turn any Software into an Agent Environment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.06126","snapshot_observed_at":"2026-08-08T00:49:50.090990Z","title":"Muhammad Awais Ahmad, Tauqir Ahmed, Muhammad Aslam, Amjad Rehman, Faten S","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-09T14:10:07.509219Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.090990Z"},"links":{"cited_paper":"/paper/2604.06126","citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:379890556ecfa7cafd29950a521e89eb676ca1e6e7f0aa16f051b7ded15e103f","observation_id":"08ce8ef8-88e9-4b14-9f77-3c8baaaea9ec","resolution":{"observed_at":"2026-08-08T00:49:50.090990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:49:50.110243Z","title":"Yucheng Zeng, Weipeng Lu, Linyun Liu, Shupeng Li, Zitian Qu, Chenghao Zhu, Shaofei Li, Zhengdong Tan, Mengyue Liu, Haotian Zhao, and 1 others","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","snapshot_observed_at":"2026-08-09T14:10:07.509219Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning","version":2},"reference_index":9567,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:50.110243Z"},"links":{"citing_paper":"/paper/2608.03571"},"observation_digest":"sha256:73fc530e635fec68b3a72557508da75943e028d1aef3a9f14e9238b969b435de","observation_id":"1f66e7cd-d38a-48ef-bce0-b04a33f2237c","resolution":{"observed_at":"2026-08-08T00:49:50.110243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.03571","last_updated":"2026-08-06T02:46:18Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T14:10:07.509219Z","submitted_at":"2026-08-04T12:32:18Z","title":"Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":20,"verified_exact":0,"verified_fuzzy":3},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 0 inbound Pith citation observations for arXiv:2608.03571."}