{"as_of":"2026-08-23T07:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4ced7d96e091898befe6b754815caf775b2b3c7ede83835b4625a36ae4c83340","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T20:24:08.254315Z","state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T22:15:34.412634Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-15T22:15:35.405013Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"cited_work":{"arxiv_id":"2502.09829","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.09829","snapshot_observed_at":"2026-08-15T22:15:35.405013Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","venue":"cs.RO","work_id":"b4134f14-acd4-4c28-8e39-5f0ce6326163","year":2025},"citing_paper":{"arxiv_id":"2505.07728","last_updated":"2025-05-12T16:36:35Z","snapshot_observed_at":"2026-08-17T13:04:52.703421Z","submitted_at":"2025-05-12T16:36:35Z","title":"Guiding Data Collection via Factored Scaling Curves","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T22:15:34.412634Z"},"links":{"cited_paper":"/paper/2502.09829","citing_paper":"/paper/2505.07728"},"observation_digest":"sha256:5a9b7faa93af2e8f26d86086e9245316afa4eab02257a8ccf3263a4d071d946b","observation_id":"af482dac-a339-45dc-8ba8-3eb3f78cb76b","resolution":{"observed_at":"2026-08-15T22:15:35.412151Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.09829/citation-record","integrity":"/paper/2502.09829/integrity","json":"/paper/2502.09829/citation-record.json","paper":"/paper/2502.09829"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:24:09.079135Z","title":"Sim-to-real transfer for vision-and-language navigation","venue":null,"work_id":"fd52b5d4-0613-4907-8e62-f2ff39df1f34","year":2021},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.005910Z"},"links":{"citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:aadc88221408d88b03acba911e9fbba1d95f786d13a7aa4c2cbf48d1095eddd4","observation_id":"26c6ca63-413b-481a-93ed-bf280aed8ed2","resolution":{"observed_at":"2026-08-07T20:24:09.084157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:24:09.063814Z","title":"Con- trast sets for evaluating language-guided robot policies","venue":null,"work_id":"dee66337-7f91-4e3a-999d-2536f228faa9","year":2024},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.011688Z"},"links":{"citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:cdd98c6b03688e6f21ba44c917586eed917a1a5d39ef64aecb2dac6d7fdd7809","observation_id":"ed285a56-c073-4fc5-92c2-1360f2f1e3d6","resolution":{"observed_at":"2026-08-07T20:24:09.069010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:24:09.049308Z","title":"Remembr: Building and reasoning over long-horizon spatio-temporal memory for robot navigation","venue":null,"work_id":"bad855bc-ec2a-4684-847d-e73c7b221ee5","year":2025},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.016879Z"},"links":{"citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:ff9a5f4643576b4ddf277da158f7d6d65a74fe028c2d0c9c1371ba2c83dc383a","observation_id":"a94521aa-8179-4cf4-a5a7-c1e53b0b35b7","resolution":{"observed_at":"2026-08-07T20:24:09.053902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:24:09.035103Z","title":"Surrogate assisted generation of human-robot interaction scenarios","venue":null,"work_id":"5d3935cb-6bb1-41ed-8caf-389531144b2e","year":2023},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.022672Z"},"links":{"citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:22d98ee3938872ecc36e7ec06c74152598d60572270555e39a4b5a2d4a6d0046","observation_id":"b6c14229-43af-4668-9123-170bb3a08b9d","resolution":{"observed_at":"2026-08-07T20:24:09.039893Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:24:09.019775Z","title":"Mixture density networks","venue":null,"work_id":"841a6d6c-8960-4abf-af57-b05b389f5ff1","year":1994},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.027904Z"},"links":{"citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:fea44c71c79f08ee56dc524fa1db9f8ebeadd5712baec06e528a0c52d92a92e9","observation_id":"cc92b23e-6d74-4a9e-a3e9-948afe2cdf3c","resolution":{"observed_at":"2026-08-07T20:24:09.025105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-08-16T17:53:54.636855Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-08-07T20:24:08.032884Z","title":"π0: A vision- language-action flow model for general robot control","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.032884Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:8a0961557e8084c36019d8e761d4a37ff591985430609f1cd5a11c9265a1c682","observation_id":"db870277-d89b-4a27-89cc-73048e4422ed","resolution":{"observed_at":"2026-08-07T20:24:08.032884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1012.2599","last_updated":"2010-12-12T22:53:04Z","snapshot_observed_at":"2026-08-15T05:00:14.232397Z","submitted_at":"2010-12-12T22:53:04Z","title":"A Tutorial on Bayesian Optimization of Expensive Cost Functions, with Application to Active User Modeling and Hierarchical Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1012.2599","snapshot_observed_at":"2026-08-07T20:24:08.038303Z","title":"A tutorial on bayesian optimization of expensive cost functions, with application to active user modeling and hierarchical reinforcement learning","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.038303Z"},"links":{"cited_paper":"/paper/1012.2599","citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:cd6d35a1f741ea1a0a149179f650521be5fccaa7518d546a3f571ef2e6b83823","observation_id":"f22198aa-5c07-48af-a897-8d3fffdc7860","resolution":{"observed_at":"2026-08-07T20:24:08.038303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:24:09.005195Z","title":"A survey on evaluation of large language models","venue":null,"work_id":"fd83e2f1-69c9-4d5d-8358-d4493583320e","year":2024},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.043968Z"},"links":{"citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:63ff6650b8e894d017b142ae3587387f915a41335aae08122822c8257fd67ecc","observation_id":"a89ec4cd-1752-49f3-9edd-5370b68f058a","resolution":{"observed_at":"2026-08-07T20:24:09.010063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:24:08.991269Z","title":"Learning surrogate models for simulation-based opti- mization","venue":null,"work_id":"88bdb434-6c25-4d92-b41c-9e39f74466ce","year":2014},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.048745Z"},"links":{"citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:8cf878cd75711dc9bc388c8a4c479b1fb977030a2559f164aae8f62683f6ed71","observation_id":"7af56f50-e073-4895-9362-7eaeeb9e849c","resolution":{"observed_at":"2026-08-07T20:24:08.995807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:24:08.977441Z","title":"RoboTHOR: An Open Simulation-to-Real Embodied AI Platform","venue":null,"work_id":"a118a46b-8119-43e0-bdd7-9630d38ddbc6","year":2020},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.053466Z"},"links":{"citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:ecee111f6b17bde60e180b7e829107d46e2549a0cd843ca0121b7cf760c12ef3","observation_id":"2559ab78-111d-49eb-900b-57a59fde8450","resolution":{"observed_at":"2026-08-07T20:24:08.982018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:24:08.960340Z","title":"Efficient benchmarking of hyper- parameter optimizers via surrogates","venue":null,"work_id":"5e5bc6df-3716-402c-81ef-6ea783c841a6","year":2015},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.058304Z"},"links":{"citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:5e393840d333bd51ff4657b374f8219b13c5527ccc06ab9b51811053d8b8ccff","observation_id":"7cf5f8fa-e923-4c70-9727-6bfae3fff535","resolution":{"observed_at":"2026-08-07T20:24:08.964796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:24:08.945674Z","title":"Dropout as a bayesian approximation: Representing model uncertainty in deep learning","venue":null,"work_id":"aa82a31b-4ab0-40ff-8be8-4638c6062597","year":2016},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.063294Z"},"links":{"citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:eea3cf001d9a8293351be533cf58924b4d95653399b62a28e4babc6e11ce7b63","observation_id":"55e5f08b-1cff-4d78-a5ab-059acbd87550","resolution":{"observed_at":"2026-08-07T20:24:08.950854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:24:08.932160Z","title":"Efficient Data Collection for Robotic Manipulation via Compositional Generalization","venue":null,"work_id":"1d5a308e-50d4-4824-b6b6-fac4729f4988","year":2024},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.067842Z"},"links":{"citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:3de1e7cdf5ada7c66f484f123d8c7feca4be86b1ca1bc2bef5e8ca024995cacf","observation_id":"fadbd227-7ddb-47a9-b67b-8ce59014fc0e","resolution":{"observed_at":"2026-08-07T20:24:08.936588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:24:08.918071Z","title":"Liu, Phoebe Mul- caire, Qiang Ning, Sameer Singh, Noah A","venue":null,"work_id":"064ac01f-fc9e-452f-81b2-594424e54830","year":2020},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.072828Z"},"links":{"citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:7240938f5180f029764d12bffd7a0c19e14aaa45d742729630e5ab764f30b10f","observation_id":"663b53e1-19c5-4ca3-abaf-0fcec1a5f52b","resolution":{"observed_at":"2026-08-07T20:24:08.922623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:24:08.903853Z","title":"Navigating to objects in the real world","venue":null,"work_id":"8ab2ae72-80d3-4b61-805e-d2c6b5e3fa19","year":2023},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.077336Z"},"links":{"citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:96a136cad43ac89dc62bd2208c3adffb66f471beddb6dc038752ae614de0d180","observation_id":"f9ebe5db-34ae-4c54-8d89-1eb480d460c8","resolution":{"observed_at":"2026-08-07T20:24:08.908659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:24:08.889882Z","title":"Minillm: Knowledge distillation of large language mod- els","venue":null,"work_id":"e4811384-ba97-4045-8dfe-d72dfa751023","year":2024},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.081928Z"},"links":{"citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:098535b169dca8264b5f9a9087007534c67713298519d204c33705af1a09e762","observation_id":"7b9e03f1-767c-4715-9a1e-7908ecd69939","resolution":{"observed_at":"2026-08-07T20:24:08.894585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:24:08.876062Z","title":"World models","venue":null,"work_id":"c525a822-1539-4d8e-8897-2c501235d587","year":2018},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.086506Z"},"links":{"citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:dd90afad81232851df76ba63c59fcdc04ec6b63496951369d4a11bcf784e515f","observation_id":"40d46ed5-1ef9-438f-b1ce-3ad86553ddaa","resolution":{"observed_at":"2026-08-07T20:24:08.880292Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:24:08.862044Z","title":"Benchmarking neural network robustness to common corruptions and perturbations","venue":null,"work_id":"45df8f14-fe22-4fa5-872e-91712a8b57e2","year":2019},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.091677Z"},"links":{"citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:c2814d7abf5dc81684e6bc8240f445a11897a5b405ba5442d57fe0669cea3529","observation_id":"ae60c01c-38bb-4eab-bda8-933256a9e198","resolution":{"observed_at":"2026-08-07T20:24:08.866591Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:24:08.848134Z","title":"Pretrained transformers improve out-of-distribution robustness","venue":null,"work_id":"a5651bd0-b23c-4cd7-a872-ec6bbb77b566","year":2020},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.096785Z"},"links":{"citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:b5def448bfc0d5d9056a1d368db656d8a3c75749cb36ba4ef5464a902f5d7888","observation_id":"3c0329c7-1abc-44ab-923c-bd8c08fd8085","resolution":{"observed_at":"2026-08-07T20:24:08.852914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1112.5745","last_updated":"2011-12-24T17:53:19Z","snapshot_observed_at":"2026-08-17T04:17:54.065503Z","submitted_at":"2011-12-24T17:53:19Z","title":"Bayesian Active Learning for Classification and Preference Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1112.5745","snapshot_observed_at":"2026-08-07T20:24:08.101849Z","title":"Bayesian active learning for classification and preference learning","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.101849Z"},"links":{"cited_paper":"/paper/1112.5745","citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:c16b09183f6d163241e1c01f666893103b4dccd1b043003d7479b0211a10130e","observation_id":"c923236e-2c6a-4d33-9749-448d587481be","resolution":{"observed_at":"2026-08-07T20:24:08.101849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:24:08.833490Z","title":"Deploying and Evaluating LLMs to Program Service Mobile Robots","venue":null,"work_id":"91da3bd9-ceb1-4338-bdd5-83a9da1d1d6b","year":2024},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.107159Z"},"links":{"citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:d00959ab37757d15a8399ea42d2927b7bdf4b668b724c2fac669abeaf5100a23","observation_id":"60d4b5d4-e7a8-4930-b747-99cbbc76109a","resolution":{"observed_at":"2026-08-07T20:24:08.838641Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:24:08.818877Z","title":"Sim2Real Predictivity: Does Evaluation in Simulation Predict Real- World Performance? IEEE Robotics and Automation Letters (RA-L), 2020","venue":null,"work_id":"c1a6acdf-2988-43b1-96dc-78159ef47258","year":2020},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.111866Z"},"links":{"citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:eabd9423fda2791656f094cfb2c495a7a7af66742bd1b3346c56751c80447baf","observation_id":"fd54f599-94bd-4af1-a767-60d7402d995f","resolution":{"observed_at":"2026-08-07T20:24:08.823846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:24:08.803870Z","title":"Openvla: An open-source vision-language-action model","venue":null,"work_id":"f4036a6c-bac5-42a5-a2a1-d32afe1a303c","year":2024},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.116672Z"},"links":{"citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:ebd38ea32c07b7a2fcc98f71a3ec6b543f7d0d2bce29567f5550048c57e64097","observation_id":"0220736c-de73-4e23-a708-e1c0eed7aebe","resolution":{"observed_at":"2026-08-07T20:24:08.808906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:24:08.789080Z","title":"Active testing: Sample-efficient model eval- uation","venue":null,"work_id":"84da4271-4020-4c1a-90dc-dc0b294d9657","year":2021},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.121494Z"},"links":{"citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:17ae2289f608a76218ca802ef1f488fff818029e1d33744e54e1ad743e8cc463","observation_id":"7254eecc-6edb-4afd-b687-2409a6c5afb6","resolution":{"observed_at":"2026-08-07T20:24:08.794038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:24:08.773351Z","title":"Robot learn- ing as an empirical science: Best practices for policy evaluation","venue":null,"work_id":"aa885550-1e3e-4968-9583-e8cbd9f5be18","year":2024},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.126153Z"},"links":{"citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:28dfc86e644222bfe196edf6b8d3153066a0c7c1c95e997266444887e2487ab5","observation_id":"345be716-df4f-4671-a31c-23085459e484","resolution":{"observed_at":"2026-08-07T20:24:08.778709Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:24:08.759223Z","title":"Dropout injection at test time for post hoc uncertainty quantification in neural networks","venue":null,"work_id":"5cb4e129-c3c5-454b-92ad-96675bc51a06","year":2023},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.132137Z"},"links":{"citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:778123a7e7eba5d4656a565b2588b0e5d92ad6be0bc8c8f5b76cbcf1dae981c2","observation_id":"f273a139-e0bd-4c76-be64-b1bd2191dfd9","resolution":{"observed_at":"2026-08-07T20:24:08.763886Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2003.10870","last_updated":"2020-03-22T14:51:04Z","snapshot_observed_at":"2026-08-19T22:50:42.918415Z","submitted_at":"2020-03-22T14:51:04Z","title":"Cost-aware Bayesian Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.10870","snapshot_observed_at":"2026-08-07T20:24:08.136868Z","title":"Cost-aware bayesian optimization","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.136868Z"},"links":{"cited_paper":"/paper/2003.10870","citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:3bc974b7a534bf5daa95797a8b26d41899b582302c7942c2e3bf426f218bae2f","observation_id":"b966978c-e2d1-485a-9ba5-56afc1409e74","resolution":{"observed_at":"2026-08-07T20:24:08.136868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:24:08.744851Z","title":"Evaluating real-world robot manipulation policies in sim- ulation","venue":null,"work_id":"dd208ba8-474a-41bb-b12e-0028b1672cee","year":2024},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.141947Z"},"links":{"citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:aa721a741f055c06329ace0a7223032ae6a7023260c4f0463fa0b51e13724c5d","observation_id":"f9782aab-e785-462e-9e64-ba8d3e0c759b","resolution":{"observed_at":"2026-08-07T20:24:08.749435Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:24:08.730212Z","title":"Ham- ster: Hierarchical action models for open-world robot manipulation","venue":null,"work_id":"c4698a7c-fcc4-4c11-94a6-72460d622ba4","year":2025},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.146913Z"},"links":{"citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:ba24c75c6c70593bbe8ef608fcc3caa8b043cf5feba2fa8fef031bdc46112b03","observation_id":"e6f2b0d9-07de-42b5-b5a7-47db44b4efdd","resolution":{"observed_at":"2026-08-07T20:24:08.735234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:24:08.715751Z","title":"Holistic evaluation of language models","venue":null,"work_id":"04a6bbdc-ecce-4b0c-b34f-6d0a54369462","year":2022},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.151565Z"},"links":{"citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:bfc188842a91fd08dbcbaf8be17ac16245650b45193f3e3b8172feee678e757a","observation_id":"b9cab6f8-e7db-4cfb-96e6-2392c58d760a","resolution":{"observed_at":"2026-08-07T20:24:08.720648Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:24:08.701364Z","title":"A general framework for uncertainty estimation in deep learning","venue":null,"work_id":"3ae512a9-4e26-4d89-bd76-68dd8dc43a94","year":2020},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.155969Z"},"links":{"citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:1a31c452d014d080605a99711c7dc32b39db4b2cc1e61b857e0bfc13ea516c7e","observation_id":"e4d9510a-19ce-4c7c-b63d-7146c9900ee1","resolution":{"observed_at":"2026-08-07T20:24:08.706028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:24:08.687097Z","title":"Probabilistic matrix factorization","venue":null,"work_id":"05d8f93d-33b1-44b1-885b-44478cefc3d4","year":2007},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.160717Z"},"links":{"citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:e80d33ee3fe81c52021541ad9feec1996a6680b63604fb1f0a58625563c5696f","observation_id":"ec8a53fe-460d-453b-9e82-7eda7d2072d0","resolution":{"observed_at":"2026-08-07T20:24:08.691595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:24:08.672368Z","title":"Differential assessment of black-box ai agents","venue":null,"work_id":"fa715cc6-2f12-4f12-b9be-2796329605fe","year":2022},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.165429Z"},"links":{"citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:706680162fec68b218d1200119998bd3bb29fd0ef3e2c6a8b7cabdcfbfccc130","observation_id":"0510ec4a-e5a2-4c0a-8277-218380b6ea71","resolution":{"observed_at":"2026-08-07T20:24:08.677074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:24:08.657034Z","title":"Octo: An open-source generalist robot policy","venue":null,"work_id":"8eebeb08-898b-4a1b-80bc-8a1923e82b06","year":2024},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.170063Z"},"links":{"citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:4cda673657b28fd14b370899a14eca375d51cf1adb9b87bb94138934ee1fa60a","observation_id":"8d361def-f9ec-4b91-bbb9-e2cf162c2127","resolution":{"observed_at":"2026-08-07T20:24:08.661880Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:24:08.641377Z","title":"Investigating the Role of Instruction Variety and Task Difficulty in Robotic Manipulation Tasks","venue":null,"work_id":"4cbf36f6-f44f-403d-b5c3-797c3c0b5085","year":2024},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.174469Z"},"links":{"citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:2ed4379a0f9955a9a52362e778cc4f1256c7489fcad425776617136e075b39b2","observation_id":"485d3982-4785-4bc9-9df6-b9ca7e4476ac","resolution":{"observed_at":"2026-08-07T20:24:08.646307Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:24:08.625055Z","title":"Cost-aware bayesian optimization via information directed sampling","venue":null,"work_id":"3e901f62-e78c-4eef-a484-60a3ed86a3ca","year":2020},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.179124Z"},"links":{"citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:22e2bbe7db8f8982ed4c5c946e612e1ddad8abefa3ae1cc7de7fb8791af69ece","observation_id":"6485b935-0ae8-457b-b4bb-7a710568aac7","resolution":{"observed_at":"2026-08-07T20:24:08.630414Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:24:08.607903Z","title":"THE COLOS- SEUM: A Benchmark for Evaluating Generalization for Robotic Manipulation","venue":null,"work_id":"6988d097-1167-4722-9919-4e8d62cb9d85","year":2024},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.183537Z"},"links":{"citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:6050eaf2506b27baa1861750caeff65793eac3cad85bb51741d6b610c8650ba1","observation_id":"c4a3c133-140d-4825-a647-ecf73f7f4213","resolution":{"observed_at":"2026-08-07T20:24:08.613142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:24:08.591662Z","title":"Building surrogate models based on detailed and approximate simulations","venue":null,"work_id":"b54a2f65-bffa-4139-aefe-0a438ee7e574","year":2006},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.187971Z"},"links":{"citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:8685a8e926985b51b8456091d870f0f265f6fe86cab0ba0624578dec218f7c60","observation_id":"c1c848a8-6bb5-4efd-bc03-dc74cf668a9a","resolution":{"observed_at":"2026-08-07T20:24:08.596637Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:24:08.577129Z","title":"Modern bayesian experimental design","venue":null,"work_id":"94087729-b3d7-4d2d-9fa4-605ce87ad307","year":2024},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.192597Z"},"links":{"citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:d29f25a9dae3c2f5c18befa81289746d9d12bf00d852924427658d15bb3bac53","observation_id":"5fcfeaf2-47ed-4286-8fa4-f33c7eec3645","resolution":{"observed_at":"2026-08-07T20:24:08.581857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:24:08.562374Z","title":"Do imagenet classifiers generalize to imagenet? In International Conference on Machine Learning (ICML), 2019","venue":null,"work_id":"ed9dd237-714e-44cd-af10-08bcaf0f0275","year":2019},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.197577Z"},"links":{"citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:94c2f3be5a6833a3986c7e2ba3bd95500465b1e6d192953bf3a6bc6e7ac70836","observation_id":"7bb24d94-39b3-4b04-bf42-c0f64301c6d9","resolution":{"observed_at":"2026-08-07T20:24:08.567419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:24:08.546297Z","title":"Active risk estimation","venue":null,"work_id":"476c92d6-7ee3-4b56-b05d-fa86b44aa95b","year":2010},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.202262Z"},"links":{"citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:3a3490dc786efc49e3547bcaf2d186f443e9471d2e0154dc5f1873c73c6c09ac","observation_id":"3baddab0-c4cb-423c-bb0a-c2b21ac47fdf","resolution":{"observed_at":"2026-08-07T20:24:08.550901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:24:08.529862Z","title":"Vint: A foundation model for visual navigation","venue":null,"work_id":"10409e69-021c-401c-928f-308a1136c311","year":2022},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.206920Z"},"links":{"citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:356bf0348cd9ec82875cd5371fce67880b2927b9e9b612b9fbd49f87c9c1f223","observation_id":"35f8747c-1dc2-4f35-b18a-4273c8bf4a8f","resolution":{"observed_at":"2026-08-07T20:24:08.535117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:24:08.513113Z","title":"Lm- nav: Robotic navigation with large pre-trained models of language, vision, and action","venue":null,"work_id":"6b851ac5-7db0-4bc5-9c72-a957ad31b8d0","year":2023},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.211508Z"},"links":{"citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:d86ea2fefd3f8839a0042c68a489f605a0044f8d6c5998fe1b0ebe264526370e","observation_id":"6e72152f-c96f-4b56-89ea-b38137f396d2","resolution":{"observed_at":"2026-08-07T20:24:08.518129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:24:08.497513Z","title":"Taking the human out of the loop: A review of bayesian optimization","venue":null,"work_id":"970b0fd9-28a4-4c41-90ec-358fb323ae11","year":2015},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.216126Z"},"links":{"citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:b5da8d11485a8ac56c668b4d024f2c3ac9c6f6a37d6105bfef53673a28509daf","observation_id":"dc026d25-b7dd-4277-90d1-d17e9346d0c1","resolution":{"observed_at":"2026-08-07T20:24:08.502523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.12122","last_updated":"2022-10-21T17:22:03Z","snapshot_observed_at":"2026-08-18T07:40:24.636470Z","submitted_at":"2022-10-21T17:22:03Z","title":"Targeted active learning for probabilistic models","version":1},"cited_work":{"arxiv_id":"2210.12122","doi":null,"metadata_source":"pith","pith_arxiv_id":"2210.12122","snapshot_observed_at":"2026-08-07T20:24:08.313829Z","title":"Targeted active learning for probabilistic models","venue":"cs.LG","work_id":"f2f532ef-7d74-4c08-ab6b-50a2c752a730","year":2022},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.220721Z"},"links":{"cited_paper":"/paper/2210.12122","citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:58072f535481f6c6439ad03b99a180a3767f5b95378808ca529e8aefddc14049","observation_id":"53efac60-5367-47f7-b1ca-6fe513fef398","resolution":{"observed_at":"2026-08-07T20:24:08.321102Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:24:08.481028Z","title":"Discovering user-interpretable capabilities of black-box planning agents","venue":null,"work_id":"bfcfc028-1c30-411a-b358-abe2fda51da8","year":2021},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.225896Z"},"links":{"citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:b9b3a2ac97f198516674d4b4d8a6bc3e81eec3a09db6ebf8e2865a6dc6ef8b70","observation_id":"fe7e84a9-ab7e-4e51-acb8-099f44cdbdb4","resolution":{"observed_at":"2026-08-07T20:24:08.486723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:24:08.463640Z","title":"Autonomous capability assessment of sequen- tial decision-making systems in stochastic settings","venue":null,"work_id":"694539cb-e952-4af0-9a16-c05b2062e6ce","year":2023},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.230274Z"},"links":{"citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:2a0242688e03f97ef313db51b9e1c1c7cad484fa9f5a3de27f863cc1f6353c08","observation_id":"899f423e-4ef5-44af-82b2-1b9f420132ad","resolution":{"observed_at":"2026-08-07T20:24:08.469447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:24:08.447219Z","title":"How Generalizable Is My Behavior Cloning Policy? A Statis- tical Approach to Trustworthy Performance Evaluation","venue":null,"work_id":"008ec71e-edd8-4ad8-a434-33096a79eb2c","year":2024},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.234744Z"},"links":{"citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:c335a38c2beebab3bbfa4f97799906019416608f1e8afd3a055d4e630460bd71","observation_id":"b8e12e8f-c18d-43fb-bbde-97d163b158a2","resolution":{"observed_at":"2026-08-07T20:24:08.452435Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:24:08.430992Z","title":"CLINE: Contrastive Learning with Semantic Negative Examples for Natural Language Understanding","venue":null,"work_id":"edbc9ca0-74dd-43dd-b120-2a73d57e4460","year":2021},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.239673Z"},"links":{"citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:494bb6493bb15e1b5884624b138895abc0e49c3f3ab01f5ad3d617efeff1f886","observation_id":"e85d0b1b-4eb4-4f05-8848-d96ae0fd9673","resolution":{"observed_at":"2026-08-07T20:24:08.436050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:24:08.413862Z","title":"Decomposing the generalization gap in imitation learning for visual robotic manipulation","venue":null,"work_id":"52bf7a18-97bb-4a16-a4af-0cc3b8e5b918","year":2024},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.244153Z"},"links":{"citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:434c71c1ab22e422cffc9e1bd12a3b537b9518df4bf223abcb93db3d53b29fa1","observation_id":"b65b5839-f159-4f26-a717-7a1f269544a3","resolution":{"observed_at":"2026-08-07T20:24:08.419828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.12043","last_updated":"2021-09-24T16:03:58Z","snapshot_observed_at":"2026-08-16T17:54:15.475891Z","submitted_at":"2021-09-24T16:03:58Z","title":"Sample Efficient Model Evaluation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.12043","snapshot_observed_at":"2026-08-07T20:24:08.248881Z","title":"Sample efficient model evaluation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.248881Z"},"links":{"cited_paper":"/paper/2109.12043","citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:9c38b6e56280b83cb8193da08bfe748cd1dd54e4e30e232023e5d692dc520736","observation_id":"27c5d9c3-fc00-4aff-b267-6a8fa47ed7a5","resolution":{"observed_at":"2026-08-07T20:24:08.248881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:24:08.398030Z","title":"Meta- world: A benchmark and evaluation for multi-task and meta reinforcement learning","venue":null,"work_id":"455fa2fb-ae5c-46bb-a07f-24beab9b94b9","year":2020},"citing_paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T20:24:08.254315Z"},"links":{"citing_paper":"/paper/2502.09829"},"observation_digest":"sha256:6679c648f94ac4dbda1c9e5db5b5b342f9c89d763a24c7adf69e21367a8e19c5","observation_id":"b321e13e-317e-4693-8189-37ef7d9bdfca","resolution":{"observed_at":"2026-08-07T20:24:08.403255Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.09829","last_updated":"2025-02-14T00:07:02Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-16T21:52:11.058906Z","submitted_at":"2025-02-14T00:07:02Z","title":"Efficient Evaluation of Multi-Task Robot Policies With Active Experiment Selection"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":5,"verified_exact":1,"verified_fuzzy":46},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 1 inbound Pith citation observation for arXiv:2502.09829."}