{"as_of":"2026-08-21T19:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fb964639b79e74031882d09b3c074e94a4d0e4bc1a66f7254ce7d92efffc4493","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T04:12:58.275096Z","state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T17:41:40.567807Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-28T17:42:25.757588Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-18T14:02:35.047337Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"cited_work":{"arxiv_id":"2505.02010","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.02010","snapshot_observed_at":"2026-06-28T17:42:25.757588Z","title":"Meta-black-box-optimization through offline q-function learning","venue":null,"work_id":"b575a039-8995-4d20-9b48-ed4aa63a166f","year":2025},"citing_paper":{"arxiv_id":"2606.00862","last_updated":"2026-05-30T19:26:32Z","snapshot_observed_at":"2026-08-08T15:58:34.048053Z","submitted_at":"2026-05-30T19:26:32Z","title":"Meta-Black-Box Optimization with Ensemble Surrogate Modeling for Robustness-Accuracy Trade-off within SAEA","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-28T17:41:40.567807Z"},"links":{"cited_paper":"/paper/2505.02010","citing_paper":"/paper/2606.00862"},"observation_digest":"sha256:06dae2e75203910d95ae2ac9c0c1c3c57fabf0e23ed504345aa7ec796e656143","observation_id":"d7bab352-3317-48ac-93bc-f6e1e4870e71","resolution":{"observed_at":"2026-06-28T17:42:25.759635Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.02010/citation-record","integrity":"/paper/2505.02010/integrity","json":"/paper/2505.02010/citation-record.json","paper":"/paper/2505.02010"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:12:58.656381Z","title":null,"venue":null,"work_id":"7fa38b9f-ae2f-4260-b57a-55f19dc77f1b","year":2000},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-18T14:02:35.047337Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.275096Z"},"links":{"citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:64fccc5d732b957233e6ba8f4e428c8dd36145ea8cfbc154244a2e46c5d2e2f2","observation_id":"b1a690d7-55b8-4e6c-8b77-f072143e1217","resolution":{"observed_at":"2026-08-16T04:12:58.774796Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:12:58.922854Z","title":"States Notes Problem Property st 1 mean xi,xj∈Xt ||xi−xj||2 Average distance between any pair of individuals in current population","venue":null,"work_id":"69c16109-5971-41ff-9e51-1df2a6f5a94b","year":1997},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-18T14:02:35.047337Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.239030Z"},"links":{"citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:3bae911a09cdfb3089946d0a76b3d87a58f2596ef7097ffc415e5533c6eacb5f","observation_id":"acd76e7e-a27c-4893-be14-38ac41b1dc15","resolution":{"observed_at":"2026-08-16T04:12:58.928393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:12:58.825209Z","title":null,"venue":null,"work_id":"17e9b994-0a6a-428f-9009-8884d9a83e07","year":2000},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-18T14:02:35.047337Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.270940Z"},"links":{"citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:7cff3c8ffdb06f801fdc27ae4af404361baaebf476788f0d9a2ba34e6d6dabbe","observation_id":"4e3082a2-2c34-4876-8c17-9dbf601d6a98","resolution":{"observed_at":"2026-08-16T04:12:58.830109Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01881","last_updated":"2025-02-26T13:57:13Z","snapshot_observed_at":"2026-08-18T15:33:30.926724Z","submitted_at":"2024-02-02T20:12:05Z","title":"Large Language Model Agent for Hyper-Parameter Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01881","snapshot_observed_at":"2026-08-16T04:12:58.175734Z","title":"Large language model agent for hyper-parameter optimization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-18T14:02:35.047337Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.175734Z"},"links":{"cited_paper":"/paper/2402.01881","citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:5606a641fc56e78c29d9b437191cd4c86e5ea7ce1a71abb0b74a5d6e6e3afe5b","observation_id":"f2a0fba5-afd2-4e28-9a50-820283c05fad","resolution":{"observed_at":"2026-08-16T04:12:58.175734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-08-17T17:19:33.060917Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-16T04:12:58.187135Z","title":"Playing atari with deep reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-18T14:02:35.047337Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.187135Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:4745bae140dc4a8580741bb2ddb239329a65f52f1285def1a050e76d4c5f863f","observation_id":"684515a3-6bc9-4f1a-9c71-a9645e385074","resolution":{"observed_at":"2026-08-16T04:12:58.187135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-20T07:04:06.309989Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-16T04:12:58.203848Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-18T14:02:35.047337Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.203848Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:b3b8452e368e64bf3657e7a5f5b72d2f32d8311efcd07def25e8796d5351513f","observation_id":"d38b18a9-f383-4927-ad27-187b67f35f00","resolution":{"observed_at":"2026-08-16T04:12:58.203848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17423","last_updated":"2024-11-01T14:32:12Z","snapshot_observed_at":"2026-08-17T23:17:25.460983Z","submitted_at":"2024-02-27T11:32:14Z","title":"Reinforced In-Context Black-Box Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17423","snapshot_observed_at":"2026-08-16T04:12:58.208783Z","title":"Reinforced in-context black-box opti- mization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-18T14:02:35.047337Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.208783Z"},"links":{"cited_paper":"/paper/2402.17423","citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:190d0e25f1e9ecab918f8cb7e99dfa961970b37c19935c64aa66c891f97deec7","observation_id":"8a1896db-6b57-488b-b58d-41c688bf5472","resolution":{"observed_at":"2026-08-16T04:12:58.208783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:12:58.954516Z","title":"and Fukunaga, A","venue":null,"work_id":"f5cf1cb6-649b-47a1-983a-ceaaf4495d89","year":2014},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-18T14:02:35.047337Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.218416Z"},"links":{"citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:00b6dad02f33979242b9c1943835d84bba09f079b058a1c12ce44a2e7aa49114","observation_id":"117e3293-922e-4606-a655-7c9e56584705","resolution":{"observed_at":"2026-08-16T04:12:58.959246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09599","last_updated":"2024-12-23T09:33:13Z","snapshot_observed_at":"2026-08-16T15:39:18.308617Z","submitted_at":"2023-04-19T12:14:01Z","title":"DECN: Evolution Inspired Deep Convolution Network for Black-box Optimization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.09599","snapshot_observed_at":"2026-08-16T04:12:58.228648Z","title":"Decn: Evolution inspired deep convolution network for black-box optimization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-18T14:02:35.047337Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.228648Z"},"links":{"cited_paper":"/paper/2304.09599","citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:fbbc73b564c8040485419a71786256570e84f4d3eb8602910f04f1e38ce43fb1","observation_id":"fcd67b36-51a1-4e69-bf10-52a33672e243","resolution":{"observed_at":"2026-08-16T04:12:58.228648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.03419","last_updated":"2024-05-06T12:36:17Z","snapshot_observed_at":"2026-08-18T20:16:30.564137Z","submitted_at":"2024-05-06T12:36:17Z","title":"Automated Metaheuristic Algorithm Design with Autoregressive Learning","version":1},"cited_work":{"arxiv_id":"2405.03419","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.03419","snapshot_observed_at":"2026-08-16T04:12:58.327020Z","title":"Automated Metaheuristic Algorithm Design with Autoregressive Learning","venue":"cs.NE","work_id":"25e8736d-151d-4943-93e4-9c6e2e4d0575","year":2024},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-18T14:02:35.047337Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.234060Z"},"links":{"cited_paper":"/paper/2405.03419","citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:6b3ba64c1e97924a8ede4b38a752f09f6a11f9bbb601c4141d52a59ee3d6ecd2","observation_id":"221773b3-ba32-451f-88a3-aff77b2bb079","resolution":{"observed_at":"2026-08-16T04:12:58.447854Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:12:58.907684Z","title":null,"venue":null,"work_id":"1fc86ee8-d45b-4949-b642-5aeba0fc71b4","year":2014},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-18T14:02:35.047337Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.246095Z"},"links":{"citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:8a835ab207b92493be0d9da0042049fa203ec2f50a792110c9916f8e9c97e4f5","observation_id":"8aca96fd-f132-4d35-b04f-4b73a7024385","resolution":{"observed_at":"2026-08-16T04:12:58.912438Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:12:58.858844Z","title":"(17) whereηc∈{ 1, 2, 3} is controllable parameter andu∈ [0, 1] is random number","venue":null,"work_id":"e83051e0-47c5-4a98-801b-bd5df8bc1e40","year":1991},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-18T14:02:35.047337Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.261132Z"},"links":{"citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:5f95c6494f3d945337245f0f02eb9870b787aca969f77b137768c004105b42f0","observation_id":"cf501bc2-6850-4c4e-9542-233a99a19ebb","resolution":{"observed_at":"2026-08-16T04:12:58.864485Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:12:58.841438Z","title":"The Exponential crossover formulated as Eq","venue":null,"work_id":"2e8d3f84-2d9b-48ef-87ca-9b1c9f7d48db","year":1997},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-18T14:02:35.047337Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.265849Z"},"links":{"citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:66cd6e180e40339e1223e451ff7e14d027581c0631cc21a0744d8933d4eb1ee9","observation_id":"b3439b35-3e34-43a9-af4a-961af34c8b87","resolution":{"observed_at":"2026-08-16T04:12:58.847260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-08-17T20:47:46.242385Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-16T04:12:58.154768Z","title":"and Dao, T","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-18T14:02:35.047337Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":1991,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.154768Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:5a969eb1d6f0300157d41a06e0db4a6b4d74e210b5cae78ba2c6e5ddd0f7dca0","observation_id":"3fbdb806-c8c2-42b7-bb1b-17834affdd7d","resolution":{"observed_at":"2026-08-16T04:12:58.154768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:12:58.892358Z","title":"clip”, “rand","venue":null,"work_id":"959efaf8-a2f8-4cce-a173-d67a02f0449f","year":1992},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-18T14:02:35.047337Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":1992,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.250847Z"},"links":{"citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:c448c1164cd3f74d924b0ea04e2da4025043d2f22b382a9b38909bd1980aba1a","observation_id":"4660b9ef-482d-4e78-a079-63283b950fd6","resolution":{"observed_at":"2026-08-16T04:12:58.897117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:12:58.984446Z","title":"C., Pearson, D","venue":null,"work_id":"074db8d2-4cd7-4527-b85e-4a68106056b9","year":1999},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-18T14:02:35.047337Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":1995,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.150426Z"},"links":{"citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:38510b0e93a0d3b5f86a770ab50e913a0f1f775ef958a48bd71011896d0f843c","observation_id":"bd249aec-9649-46f7-9340-95515454d86c","resolution":{"observed_at":"2026-08-16T04:12:58.989060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.06567","last_updated":"2018-04-20T18:38:34Z","snapshot_observed_at":"2026-08-14T20:02:29.132687Z","submitted_at":"2017-12-18T18:22:05Z","title":"Deep Neuroevolution: Genetic Algorithms Are a Competitive Alternative for Training Deep Neural Networks for Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.06567","snapshot_observed_at":"2026-08-16T04:12:58.213620Z","title":"P., Madhavan, V ., Conti, E., Lehman, J., Stanley, K","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-18T14:02:35.047337Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":1997,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.213620Z"},"links":{"cited_paper":"/paper/1712.06567","citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:4a709458a19052c67c74c53a5c60a10bf60e50fa67c1089da2ea066a6f57150e","observation_id":"0c3855ec-5c74-4dc8-92a9-e2a47c905382","resolution":{"observed_at":"2026-08-16T04:12:58.213620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:12:58.875247Z","title":"The Polynomial mutation is as follow: x′′ i = ( x′ i + ((2u) 1 1+ηm− 1)(x′ i−lb), ifu≤ 0.5; x′ i + (1− (2− 2u) 1 1+ηm )(ub−x′ i), ifu> 0.5","venue":null,"work_id":"bdf5ee4d-aa19-4f93-88be-796bc6c736e5","year":1992},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-18T14:02:35.047337Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":1999,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.255932Z"},"links":{"citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:0c676eabf04286edb0870f13b02740257a91a195a6dba171f32e8c9ff30360ff","observation_id":"a1f5ef90-a9b9-4150-b4a9-0ba5382610a6","resolution":{"observed_at":"2026-08-16T04:12:58.881066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:12:58.969678Z","title":"W., Hadi, A","venue":null,"work_id":"bc5f4611-7fca-4cba-aab4-cf9c03b73a7e","year":2021},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-18T14:02:35.047337Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":2013,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.192562Z"},"links":{"citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:d04857108d144528d6d70f211af33a4ab748eb3a0032dc1c76d58cbcd8e0a2c4","observation_id":"bed09463-35f8-4fcd-8647-5f564af4c412","resolution":{"observed_at":"2026-08-16T04:12:58.974349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:12:58.938585Z","title":"Mujoco: A physics engine for model-based control","venue":null,"work_id":"3a733a6e-2344-49d0-ab2b-e8333f8533fc","year":2012},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-18T14:02:35.047337Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.223188Z"},"links":{"citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:6a83c2249d690ac550c066d9ce4e843d10a9001e1810ab2c86d6ef6475d69e3c","observation_id":"38307373-0d0f-437f-b1d3-b5d394fd10d7","resolution":{"observed_at":"2026-08-16T04:12:58.944007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12094","last_updated":"2024-10-27T04:46:58Z","snapshot_observed_at":"2026-08-17T20:42:37.335823Z","submitted_at":"2024-05-20T15:05:47Z","title":"Is Mamba Compatible with Trajectory Optimization in Offline Reinforcement Learning?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12094","snapshot_observed_at":"2026-08-16T04:12:58.144502Z","title":"Is mamba compatible with trajectory optimization in offline reinforcement learning? arXiv preprint arXiv:2405.12094, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-18T14:02:35.047337Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.144502Z"},"links":{"cited_paper":"/paper/2405.12094","citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:53a0b9522cea0dcff9b071b99a14f9c4b56aa274509b0a60ed713524f93742fb","observation_id":"353b6159-e330-47b4-9ca8-7ba8c2d2a0e6","resolution":{"observed_at":"2026-08-16T04:12:58.144502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-08-21T15:57:22.153221Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-16T04:12:58.170426Z","title":"Discovering attention-based genetic algorithms via meta-black-box optimization","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-18T14:02:35.047337Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.170426Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:3102218149ff5fc09b05ef1ad965a97e4eb35aafc81362b8d099ad0a09345627","observation_id":"7bbf7f18-751a-4a8f-abab-1060df898b1d","resolution":{"observed_at":"2026-08-16T04:12:58.170426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19925","last_updated":"2024-03-29T02:25:55Z","snapshot_observed_at":"2026-08-19T02:47:51.941686Z","submitted_at":"2024-03-29T02:25:55Z","title":"Decision Mamba: Reinforcement Learning via Sequence Modeling with Selective State Spaces","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19925","snapshot_observed_at":"2026-08-16T04:12:58.198043Z","title":"Decision mamba: Reinforcement learning via sequence modeling with selective state spaces","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-18T14:02:35.047337Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.198043Z"},"links":{"cited_paper":"/paper/2403.19925","citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:ecdfe256b86ef49686a15102ab58ae81297907036a06d6bb9d9ac32dbade85a9","observation_id":"33689923-964c-41b3-8bdc-ef707cde410f","resolution":{"observed_at":"2026-08-16T04:12:58.198043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07507","last_updated":"2024-12-15T15:09:38Z","snapshot_observed_at":"2026-08-18T15:07:51.658609Z","submitted_at":"2024-12-10T13:43:51Z","title":"ConfigX: Modular Configuration for Evolutionary Algorithms via Multitask Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.07507","snapshot_observed_at":"2026-08-16T04:12:58.159226Z","title":"Deep reinforcement learning for dynamic algorithm selection: A proof-of-principle study on differential evolution","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-18T14:02:35.047337Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.159226Z"},"links":{"cited_paper":"/paper/2412.07507","citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:7fb8d14e0e2bc0e8cfa9fab7e70a4f0b52de329c1ccb3506e286760b3ae6b448","observation_id":"6b2ee1c3-3670-40a7-bbf0-a6d419bbf6a1","resolution":{"observed_at":"2026-08-16T04:12:58.159226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.10672","last_updated":"2025-03-27T01:42:03Z","snapshot_observed_at":"2026-08-19T01:29:25.553392Z","submitted_at":"2024-08-20T09:17:11Z","title":"Neural Exploratory Landscape Analysis for Meta-Black-Box-Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.10672","snapshot_observed_at":"2026-08-16T04:12:58.180780Z","title":"Neu- ral exploratory landscape analysis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-18T14:02:35.047337Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.180780Z"},"links":{"cited_paper":"/paper/2408.10672","citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:af3c75a1c201ad56aaa85ae7569a6e2c9c2d8da1d67697fa5e521038fbcdefa1","observation_id":"1b224c58-9e7f-4f1a-87db-2306e2a425e2","resolution":{"observed_at":"2026-08-16T04:12:58.180780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17098","last_updated":"2024-05-27T12:12:39Z","snapshot_observed_at":"2026-08-18T01:11:17.080940Z","submitted_at":"2024-05-27T12:12:39Z","title":"Q-value Regularized Transformer for Offline Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17098","snapshot_observed_at":"2026-08-16T04:12:58.164914Z","title":"Q-value regularized transformer for offline reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","snapshot_observed_at":"2026-08-18T14:02:35.047337Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:58.164914Z"},"links":{"cited_paper":"/paper/2405.17098","citing_paper":"/paper/2505.02010"},"observation_digest":"sha256:9adb58a33fc7f8e61f753cdb475e6d9219bd47742cd09beda1484e1602902782","observation_id":"53ed532d-424c-4a5f-892b-86071331d325","resolution":{"observed_at":"2026-08-16T04:12:58.164914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.02010","last_updated":"2025-05-04T06:41:43Z","latest_version":1,"primary_category":"cs.NE","snapshot_observed_at":"2026-08-18T14:02:35.047337Z","submitted_at":"2025-05-04T06:41:43Z","title":"Meta-Black-Box-Optimization through Offline Q-function Learning"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":1,"verified_fuzzy":9},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 1 inbound Pith citation observation for arXiv:2505.02010."}