{"as_of":"2026-08-10T12:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bec3ecb29f2d623ef6db5366aebb8e62411eefd75c1180f941d2fd8b5dc4dd6b","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T15:20:38.759814Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.16217/citation-record","integrity":"/paper/2507.16217/integrity","json":"/paper/2507.16217/citation-record.json","paper":"/paper/2507.16217"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.11018","last_updated":"2024-10-17T17:45:09Z","snapshot_observed_at":"2026-07-06T18:01:18.745347Z","submitted_at":"2024-04-17T02:49:26Z","title":"Many-Shot In-Context Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.11018","snapshot_observed_at":"2026-08-06T15:20:37.947720Z","title":"Many-shot in-context learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-08T13:31:49.745762Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:37.947720Z"},"links":{"cited_paper":"/paper/2404.11018","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:7617330e646edb78e86a46e531ba8edb3c79c114c86a38f4cd2c08b448d4cce2","observation_id":"e5e89fd3-20cc-4642-b088-769d17eb2978","resolution":{"observed_at":"2026-08-06T15:20:37.947720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-06T15:20:38.117131Z","title":"Rohan Anil, Sebastian Borgeaud, Jean-Baptiste Alayrac, Jiahui Yu, Radu Soricut, Johan Schalkwyk, Andrew M Dai, Anja Hauth, Katie Millican, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-08T13:31:49.745762Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.117131Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:6abaab19af59292016227b83364cd8274fa00c4ba56f2e24b92e7d0b034a71de","observation_id":"4260c449-f816-497e-ab0f-7f3958d2a966","resolution":{"observed_at":"2026-08-06T15:20:38.117131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00200","last_updated":"2025-03-03T19:53:28Z","snapshot_observed_at":"2026-08-04T16:59:22.807968Z","submitted_at":"2024-04-30T21:06:52Z","title":"In-Context Learning with Long-Context Models: An In-Depth Exploration","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.00200","snapshot_observed_at":"2026-08-06T15:20:38.350555Z","title":"In-context learning with long-context models: An in-depth exploration","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-08T13:31:49.745762Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.350555Z"},"links":{"cited_paper":"/paper/2405.00200","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:5f77b9540aa259263994b43122603d2d24a634051691da2c9ea0ba63abffcafe","observation_id":"7bbeede1-aceb-4780-bf81-11f250e6d22c","resolution":{"observed_at":"2026-08-06T15:20:38.350555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:39.400143Z","title":"impact of sample selection on in-context learning for entity extraction from scientific writing","venue":null,"work_id":"4d807e08-79d1-4d96-bfde-c277ff67ca1e","year":2023},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-08T13:31:49.745762Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.475720Z"},"links":{"citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:8a045485385e31896662d2d523d0b3f6f1d2c487bf0aec570b46c500ed61a812","observation_id":"91197974-bb70-419e-a4fa-fbb1f1e7438a","resolution":{"observed_at":"2026-08-06T15:20:39.405156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.findings-emnlp.338","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"doi: 10.18653/v1/2023.findings-emnlp.338","venue":null,"work_id":"b4d1263a-35d7-4097-84aa-ece4a8406087","year":2023},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-08T13:31:49.745762Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.506227Z"},"links":{"citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:0bad1ecce190fe76166a0f8cc15249462c7fb4f635f6c5d05df532467d212161","observation_id":"29bf1371-ae60-49f6-bca4-c790bdedfca5","resolution":{"observed_at":"2026-08-06T15:20:38.809679Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:39.383493Z","title":"Papailiopoulos, and Kangwook Lee","venue":null,"work_id":"b06e0312-d468-402e-85ff-18cc46213c44","year":2022},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-08T13:31:49.745762Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.590206Z"},"links":{"citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:048c1f6a3763fc5daedc359db51a7206441bff0918c28a4a9a61fbb62e658b33","observation_id":"e91cdd25-7fa1-4323-949b-6a977d22db21","resolution":{"observed_at":"2026-08-06T15:20:39.388329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10171","last_updated":"2024-02-15T18:19:16Z","snapshot_observed_at":"2026-08-08T16:22:41.396147Z","submitted_at":"2024-02-15T18:19:16Z","title":"Data Engineering for Scaling Language Models to 128K Context","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10171","snapshot_observed_at":"2026-08-06T15:20:38.626324Z","title":"Data engineering for scaling language models to 128k context","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-08T13:31:49.745762Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.626324Z"},"links":{"cited_paper":"/paper/2402.10171","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:cc94663f8f6d2a27e22f7d3f5a3755749c20135b380596efd0b8dea3f7193a9f","observation_id":"6089dcf4-55b7-4407-a7b9-99669a33a215","resolution":{"observed_at":"2026-08-06T15:20:38.626324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-06T15:20:38.631968Z","title":"Gemini 1.5: Unlocking multimodal understand- ing across millions of tokens of context","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-08T13:31:49.745762Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.631968Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:e6572dd1651688559d4916f94c6f7c93254028a3e259f73578694331ae54d466","observation_id":"29e7bc85-96b5-4e8d-98f4-d4321f4b82bc","resolution":{"observed_at":"2026-08-06T15:20:38.631968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:39.368407Z","title":"Time travel in llms: Tracing data contamina- tion in large language models","venue":null,"work_id":"2d4cd945-2cfb-4d91-866b-8cdd180c9cab","year":2024},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-08T13:31:49.745762Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.636179Z"},"links":{"citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:e42395ab210443db83a4426402665ff73ad9b59fb5e9cd85b3cc40899309cfe8","observation_id":"4944664d-a834-4a4f-8659-fc32c73a031a","resolution":{"observed_at":"2026-08-06T15:20:39.373412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11546","last_updated":"2025-04-04T02:50:14Z","snapshot_observed_at":"2026-08-09T17:42:31.036904Z","submitted_at":"2024-08-21T11:54:22Z","title":"Memorization in In-Context Learning","version":3},"cited_work":{"arxiv_id":"2408.11546","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.11546","snapshot_observed_at":"2026-08-06T15:20:39.096329Z","title":"Memorization in In-Context Learning","venue":"cs.CL","work_id":"89cf4720-d403-4744-b680-6dca5be482c4","year":2024},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-08T13:31:49.745762Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.640618Z"},"links":{"cited_paper":"/paper/2408.11546","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:7f2617032ec033f2640ce6649fdf3c0962fed69d997b0a12f4071926e391d02d","observation_id":"e803960a-142f-48d5-b84e-bf3718edcfcd","resolution":{"observed_at":"2026-08-06T15:20:39.100399Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.06713","last_updated":"2022-12-13T16:31:21Z","snapshot_observed_at":"2026-08-08T00:22:20.371220Z","submitted_at":"2022-12-13T16:31:21Z","title":"Structured Prompting: Scaling In-Context Learning to 1,000 Examples","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.06713","snapshot_observed_at":"2026-08-06T15:20:38.648781Z","title":"Accessed: 2025-03-28","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-08T13:31:49.745762Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.648781Z"},"links":{"cited_paper":"/paper/2212.06713","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:2e330972ef2d629f495db25ae81dcf8a48f4dc6e86e35c6a404bdbd97eb24bd6","observation_id":"9611d3c9-7e26-4b39-9233-d0419d37f5eb","resolution":{"observed_at":"2026-08-06T15:20:38.648781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15916","last_updated":"2023-10-24T15:17:14Z","snapshot_observed_at":"2026-08-08T16:51:13.490204Z","submitted_at":"2023-10-24T15:17:14Z","title":"In-Context Learning Creates Task Vectors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15916","snapshot_observed_at":"2026-08-06T15:20:38.652663Z","title":"In-context learning creates task vectors","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-08T13:31:49.745762Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.652663Z"},"links":{"cited_paper":"/paper/2310.15916","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:b6112b913f3dfac567959bcad0f651da7634ed540abd67ce7f87b2a58669ea0f","observation_id":"9cb024c4-16b0-4950-b111-3ee26af8895f","resolution":{"observed_at":"2026-08-06T15:20:38.652663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09798","last_updated":"2024-10-04T21:51:47Z","snapshot_observed_at":"2026-07-06T18:15:03.339204Z","submitted_at":"2024-05-16T04:02:43Z","title":"Many-Shot In-Context Learning in Multimodal Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09798","snapshot_observed_at":"2026-08-06T15:20:38.661092Z","title":"Many-shot in-context learning in multimodal foundation models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-08T13:31:49.745762Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.661092Z"},"links":{"cited_paper":"/paper/2405.09798","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:ba6fb1e5e185c795885d116902434b09dde825859c66eb08f27d69efc1fb728f","observation_id":"95eb9f2f-dd60-4303-995a-fb97ec87b6d8","resolution":{"observed_at":"2026-08-06T15:20:38.661092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.12375","last_updated":"2024-03-13T15:00:20Z","snapshot_observed_at":"2026-08-10T10:41:44.155126Z","submitted_at":"2023-07-23T16:54:41Z","title":"In-Context Learning Learns Label Relationships but Is Not Conventional Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.12375","snapshot_observed_at":"2026-08-06T15:20:38.665510Z","title":"In-context learning in large language models learns label relationships but is not conventional learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-08T13:31:49.745762Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.665510Z"},"links":{"cited_paper":"/paper/2307.12375","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:1ad2b4148a62f1d4d01c24ff0dfa576c8fa14cd12c9fd31c0add7da75305be10","observation_id":"6f8215d5-9b8f-48d8-ac21-8d5d05745e2b","resolution":{"observed_at":"2026-08-06T15:20:38.665510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.20327","last_updated":"2024-03-29T17:56:40Z","snapshot_observed_at":"2026-08-10T06:35:52.406463Z","submitted_at":"2024-03-29T17:56:40Z","title":"Gecko: Versatile Text Embeddings Distilled from Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.20327","snapshot_observed_at":"2026-08-06T15:20:38.669434Z","title":"Gecko: Versatile text embeddings distilled from large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-08T13:31:49.745762Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.669434Z"},"links":{"cited_paper":"/paper/2403.20327","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:27ab56042cd643cb5b8556d7b89c4c9a7730ced07a562d4552ed9f6332ff5f88","observation_id":"2019cac0-bec2-4ea6-bd9d-013e0c9b7373","resolution":{"observed_at":"2026-08-06T15:20:38.669434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05579","last_updated":"2024-12-10T05:49:12Z","snapshot_observed_at":"2026-07-31T01:42:39.468673Z","submitted_at":"2024-12-07T08:07:24Z","title":"LLMs-as-Judges: A Comprehensive Survey on LLM-based Evaluation Methods","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05579","snapshot_observed_at":"2026-08-06T15:20:38.673094Z","title":"Llms-as-judges: A comprehensive survey on llm-based evaluation methods","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-08T13:31:49.745762Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.673094Z"},"links":{"cited_paper":"/paper/2412.05579","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:9451b9421b4011d6ae0279fe2b97f07659da845db2ea21de1522b57c121c0e1b","observation_id":"2b114263-aba0-4e37-ab0b-864fca969c3f","resolution":{"observed_at":"2026-08-06T15:20:38.673094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.06804","last_updated":"2021-01-17T23:38:40Z","snapshot_observed_at":"2026-08-02T23:15:54.644289Z","submitted_at":"2021-01-17T23:38:40Z","title":"What Makes Good In-Context Examples for GPT-$3$?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.06804","snapshot_observed_at":"2026-08-06T15:20:38.681218Z","title":"What makes good in-context examples for gpt-3? arXiv preprint arXiv:2101.06804,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-08T13:31:49.745762Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.681218Z"},"links":{"cited_paper":"/paper/2101.06804","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:1461a49f5c02d49834a9f26d5f6ee4e7787e0d16d1a725bbc0a8fe19be42da78","observation_id":"a39f48aa-7098-48ac-b5e3-ade49e8e8822","resolution":{"observed_at":"2026-08-06T15:20:38.681218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.12837","last_updated":"2022-10-20T14:04:10Z","snapshot_observed_at":"2026-08-01T15:23:39.998892Z","submitted_at":"2022-02-25T17:25:19Z","title":"Rethinking the Role of Demonstrations: What Makes In-Context Learning Work?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.12837","snapshot_observed_at":"2026-08-06T15:20:38.689665Z","title":"Rethinking the role of demonstrations: What makes in-context learning work? arXiv preprint arXiv:2202.12837,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-08T13:31:49.745762Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.689665Z"},"links":{"cited_paper":"/paper/2202.12837","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:9d4717c3e599fa0562945d3ca7775d3f90e2694b9a712a5cd57d2e71c84225a4","observation_id":"586da89a-99a3-4d85-8d54-97db4c097fdb","resolution":{"observed_at":"2026-08-06T15:20:38.689665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19089","last_updated":"2024-07-26T21:10:50Z","snapshot_observed_at":"2026-08-10T09:55:52.280582Z","submitted_at":"2024-07-26T21:10:50Z","title":"Many-Shot In-Context Learning for Molecular Inverse Design","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.19089","snapshot_observed_at":"2026-08-06T15:20:38.694814Z","title":"Many-shot in-context learning for molecular inverse design","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-08T13:31:49.745762Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.694814Z"},"links":{"cited_paper":"/paper/2407.19089","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:2cb64be27958a538f987d17c204d6ed1ca8a162ed5a3b76a8421ee0d945dbd44","observation_id":"2fca83ba-a507-464d-9217-3e2b7e203370","resolution":{"observed_at":"2026-08-06T15:20:38.694814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.14599","last_updated":"2020-05-06T17:01:56Z","snapshot_observed_at":"2026-08-09T04:22:29.127616Z","submitted_at":"2019-10-31T16:50:43Z","title":"Adversarial NLI: A New Benchmark for Natural Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.14599","snapshot_observed_at":"2026-08-06T15:20:38.699188Z","title":"Adversarial nli: A new benchmark for natural language understanding","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-08T13:31:49.745762Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.699188Z"},"links":{"cited_paper":"/paper/1910.14599","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:9832a1b871d7a99284334a6edcbf329941ee6f3f687b78b8c2591e3970a94ede","observation_id":"0d26c430-9e59-42db-a2c5-8ede77ffc4e5","resolution":{"observed_at":"2026-08-06T15:20:38.699188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:39.335993Z","title":"Can many-shot in-context learning help llms as evaluators? A preliminary empirical study","venue":null,"work_id":"7f96ebdd-3b27-4ec8-87dd-c18e52d29530","year":2025},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-08T13:31:49.745762Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.703550Z"},"links":{"citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:bb521883edcdea10cfa29a3d904d22e4d3ffc4944a54656ca824a2d1836dc0c3","observation_id":"ee487ebb-ba47-43cb-bd0a-477afc8b3e92","resolution":{"observed_at":"2026-08-06T15:20:39.341820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09261","last_updated":"2022-10-17T17:08:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-17T17:08:26Z","title":"Challenging BIG-Bench Tasks and Whether Chain-of-Thought Can Solve Them","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.09261","snapshot_observed_at":"2026-08-06T15:20:38.707607Z","title":"Mirac Suzgun, Nathan Scales, Nathanael Sch¨arli, Sebastian Gehrmann, Yi Tay, Hyung Won Chung, Aakanksha Chowdhery, Quoc V Le, Ed H Chi, Denny Zhou, et al","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-08T13:31:49.745762Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.707607Z"},"links":{"cited_paper":"/paper/2210.09261","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:8a1975127b9c2a654a91ca987fd83c3f9e4cfdfbd27e3fc78a072324cc6d4b4e","observation_id":"ae2eafa4-3769-4ce6-9239-dd9d038479b5","resolution":{"observed_at":"2026-08-06T15:20:38.707607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:39.320884Z","title":"Gomez, Lukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":"89e3c0da-0147-45e8-be96-5cac8dd312f3","year":2017},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-08T13:31:49.745762Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.715455Z"},"links":{"citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:ac1ef68cd95377f2302ce8250857ff35efe4e618d5b67ba1b75094b4be6fc2db","observation_id":"68826746-899d-487a-be83-c61eca0d80c2","resolution":{"observed_at":"2026-08-06T15:20:39.325912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15708","last_updated":"2024-11-06T22:07:17Z","snapshot_observed_at":"2026-08-02T05:05:05.468187Z","submitted_at":"2024-06-22T02:07:10Z","title":"Teach Better or Show Smarter? On Instructions and Exemplars in Automatic Prompt Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15708","snapshot_observed_at":"2026-08-06T15:20:38.723693Z","title":"press/v202/von-oswald23a.html","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-08T13:31:49.745762Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.723693Z"},"links":{"cited_paper":"/paper/2406.15708","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:8ac7becc1a5138214744762b7c23e763b16ceb15f9899085af1206447e751822","observation_id":"55544b3e-6047-4f8a-823e-e2745b3b2604","resolution":{"observed_at":"2026-08-06T15:20:38.723693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00330","last_updated":"2025-02-01T06:23:24Z","snapshot_observed_at":"2026-08-10T06:36:12.470666Z","submitted_at":"2025-02-01T06:23:24Z","title":"From Few to Many: Self-Improving Many-Shot Reasoners Through Iterative Optimization and Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00330","snapshot_observed_at":"2026-08-06T15:20:38.727777Z","title":"From few to many: Self-improving many-shot reasoners through iterative optimization and generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-08T13:31:49.745762Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.727777Z"},"links":{"cited_paper":"/paper/2502.00330","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:7e89e4574e3562142ae9a548bbd3eb6753064140f9500789bb2d3c6d76fc005c","observation_id":"c993669c-f7b4-4e3f-b7ec-005ed0ee6eb1","resolution":{"observed_at":"2026-08-06T15:20:38.727777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12685","last_updated":"2022-10-24T17:44:25Z","snapshot_observed_at":"2026-07-06T13:13:48.138379Z","submitted_at":"2022-05-25T11:45:14Z","title":"Ground-Truth Labels Matter: A Deeper Look into Input-Label Demonstrations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.12685","snapshot_observed_at":"2026-08-06T15:20:38.731801Z","title":"Ground-truth labels matter: A deeper look into input-label demonstrations","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-08T13:31:49.745762Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.731801Z"},"links":{"cited_paper":"/paper/2205.12685","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:f3cb13858363a1bbc371ef60036427c5d4df41a573f87d38caaa85a10011e4b0","observation_id":"32fb9a7a-cbf1-44e8-8f1d-9d213e3fc7df","resolution":{"observed_at":"2026-08-06T15:20:38.731801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15005","last_updated":"2023-05-24T10:45:25Z","snapshot_observed_at":"2026-08-10T05:38:31.450631Z","submitted_at":"2023-05-24T10:45:25Z","title":"Sentiment Analysis in the Era of Large Language Models: A Reality Check","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15005","snapshot_observed_at":"2026-08-06T15:20:38.735819Z","title":"Sentiment analysis in the era of large language models: A reality check","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-08T13:31:49.745762Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.735819Z"},"links":{"cited_paper":"/paper/2305.15005","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:8a18b458ec8c131a9c13a8cfdc249d0d6aa1782ae159ea5777a3a1bfdb91caa0","observation_id":"5fa91c2f-1b3f-41cd-8f40-a19b62036401","resolution":{"observed_at":"2026-08-06T15:20:38.735819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.04486","last_updated":"2022-11-08T19:00:02Z","snapshot_observed_at":"2026-08-07T09:26:55.754295Z","submitted_at":"2022-11-08T19:00:02Z","title":"Active Example Selection for In-Context Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.04486","snapshot_observed_at":"2026-08-06T15:20:38.740293Z","title":"Active example selection for in-context learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-08T13:31:49.745762Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.740293Z"},"links":{"cited_paper":"/paper/2211.04486","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:8df125eedac37978114947f50fe2f96bd11c2a9fbf73aed1ef174040d0590727","observation_id":"bffd6898-4e0f-4945-a8ea-57a087bd2866","resolution":{"observed_at":"2026-08-06T15:20:38.740293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:39.290020Z","title":"Calibrate before use: Improving few-shot performance of language models","venue":null,"work_id":"d8fd83ec-0942-47b9-891f-2ba60ddac95a","year":2021},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-08T13:31:49.745762Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.744147Z"},"links":{"citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:dcb5f9af38142e62ba59279884ec41da8610e5d5a26660662ac239fc525cab21","observation_id":"638c4bec-d0a6-4923-8012-eb74b9cdc59e","resolution":{"observed_at":"2026-08-06T15:20:39.294170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:39.276915Z","title":null,"venue":null,"work_id":"78817028-d74d-4459-ae39-7744010b0a67","year":2025},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-08T13:31:49.745762Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.748056Z"},"links":{"citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:6aaad5e0c96f184f21d928e70ea5d2f7b7d556a098308868d7e68db1f4f274be","observation_id":"22d02d1d-3d86-42eb-b700-5c81082efe2a","resolution":{"observed_at":"2026-08-06T15:20:39.281127Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:39.249812Z","title":"This portion of the prompt is updated for each downstream test sample","venue":null,"work_id":"22dfae2a-783e-4396-b98f-06d0871053f2","year":2025},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-08T13:31:49.745762Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.755614Z"},"links":{"citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:d0a88eff57b0f12d0fd89e36cdfc70b33472f3a9b368a78876b314ffcbe805b6","observation_id":"74dd82a6-c71b-478f-8116-79edc173a882","resolution":{"observed_at":"2026-08-06T15:20:39.254114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07544","last_updated":"2024-09-10T20:35:25Z","snapshot_observed_at":"2026-08-07T09:31:24.456596Z","submitted_at":"2024-04-11T08:12:43Z","title":"From Words to Numbers: Your Large Language Model Is Secretly A Capable Regressor When Given In-Context Examples","version":3},"cited_work":{"arxiv_id":"2404.07544","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.07544","snapshot_observed_at":"2026-08-06T15:20:38.891020Z","title":"From Words to Numbers: Your Large Language Model Is Secretly A Capable Regressor When Given In-Context Examples","venue":"cs.CL","work_id":"67008aa3-c0a1-488f-8d44-b99bdc41647e","year":2024},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-08T13:31:49.745762Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":1953,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.711643Z"},"links":{"cited_paper":"/paper/2404.07544","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:191d03121c93e066f4c6661f5d9412fdc2029324b61f9d54294e488116f1552b","observation_id":"c6367907-95b8-43e3-8eae-ccdbdee0014a","resolution":{"observed_at":"2026-08-06T15:20:38.896069Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:39.263563Z","title":null,"venue":null,"work_id":"49b4822f-db7c-4bdc-8535-a116cdb87935","year":2025},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-08T13:31:49.745762Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":1991,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.751701Z"},"links":{"citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:29d0bcc0686c5f328b1717f6ed25f720508970eca475db2ced33dca39242bd41","observation_id":"614594c2-3630-4643-a80d-70827129b7fd","resolution":{"observed_at":"2026-08-06T15:20:39.267622Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03128","last_updated":"2024-12-04T19:49:02Z","snapshot_observed_at":"2026-07-06T16:27:55.509482Z","submitted_at":"2023-10-04T19:39:26Z","title":"MetaTool Benchmark for Large Language Models: Deciding Whether to Use Tools and Which to Use","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03128","snapshot_observed_at":"2026-08-06T15:20:38.656905Z","title":"Yue Huang, Jiawen Shi, Yuan Li, Chenrui Fan, Siyuan Wu, Qihui Zhang, Yixin Liu, Pan Zhou, Yao Wan, Neil Zhenqiang Gong, and Lichao Sun","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-08T13:31:49.745762Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":2001,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.656905Z"},"links":{"cited_paper":"/paper/2310.03128","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:8253e7f22bafce02e5317131f0ac193b2e9d78f3419f6ca822a42ddf80fed532","observation_id":"22550fcd-f160-4d2f-bbd9-269ad5bc33d1","resolution":{"observed_at":"2026-08-06T15:20:38.656905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18819","last_updated":"2024-08-02T08:22:57Z","snapshot_observed_at":"2026-07-06T17:37:09.952632Z","submitted_at":"2024-02-29T03:06:10Z","title":"Dual Operating Modes of In-Context Learning","version":2},"cited_work":{"arxiv_id":"2402.18819","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.18819","snapshot_observed_at":"2026-08-06T15:20:38.993363Z","title":"Dual Operating Modes of In-Context Learning","venue":"cs.LG","work_id":"35dab8dd-6843-40f7-9697-1f23c010f48e","year":2024},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-08T13:31:49.745762Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":2002,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.677270Z"},"links":{"cited_paper":"/paper/2402.18819","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:11d60f8778fba4611334bfd76a4ee66119c5e1ecb9802723193ca4db619535da","observation_id":"82843581-f3b9-4302-b1a0-e522df749fc8","resolution":{"observed_at":"2026-08-06T15:20:38.997554Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:39.236230Z","title":"That error will be one of the following types: Named Entities: An entity (names, places, locations, etc.) is changed to a different entity","venue":null,"work_id":"cad67ec0-5e54-4a06-b7c6-8f406c078183","year":2025},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-08T13:31:49.745762Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.759814Z"},"links":{"citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:088c9fd1911fd69d6acc4107c4eff1bc9c568d368cb97fc2a9359846fbae90ac","observation_id":"66d6077e-d40b-4279-9a62-5657fab0871e","resolution":{"observed_at":"2026-08-06T15:20:39.240685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:39.304299Z","title":"Johannes von Oswald, Eyvind Niklasson, Ettore Randazzo, Jo ˜ao Sacramento, Alexander Mordvintsev, Andrey Zhmoginov, and Max Vladymyrov","venue":null,"work_id":"614f9c0c-d54b-4142-9897-e97c9a03d780","year":2017},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-08T13:31:49.745762Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.719460Z"},"links":{"citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:c74e81cb65c1e0bf66d9df4772d49313e806a78987545e77040454b7f889e574","observation_id":"be1332f3-9f33-48a5-8a39-7b5e3d826302","resolution":{"observed_at":"2026-08-06T15:20:39.311194Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-06T15:20:38.582379Z","title":"Longrope: Extending llm context window beyond 2 million tokens","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-08T13:31:49.745762Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.582379Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:593776d4ca521e2ab4bc35a972bc9648b8be25c3672174189ce095f81507ac02","observation_id":"93e6196b-4e58-4f7d-9496-740392bcb826","resolution":{"observed_at":"2026-08-06T15:20:38.582379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08786","last_updated":"2022-03-03T12:10:58Z","snapshot_observed_at":"2026-07-06T11:01:05.577957Z","submitted_at":"2021-04-18T09:29:16Z","title":"Fantastically Ordered Prompts and Where to Find Them: Overcoming Few-Shot Prompt Order Sensitivity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08786","snapshot_observed_at":"2026-08-06T15:20:38.685258Z","title":"Fantastically ordered prompts and where to find them: Overcoming few-shot prompt order sensitivity","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-08T13:31:49.745762Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.685258Z"},"links":{"cited_paper":"/paper/2104.08786","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:bd5b6679b78cf1f5ccaa278bde734085a3738632cdd4b67e3063fe56d98a0848","observation_id":"346b5bb3-711d-48d8-8423-0d7143312ac8","resolution":{"observed_at":"2026-08-06T15:20:38.685258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.00234","last_updated":"2024-10-05T11:47:02Z","snapshot_observed_at":"2026-07-06T14:36:25.690733Z","submitted_at":"2022-12-31T15:57:09Z","title":"A Survey on In-context Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.00234","snapshot_observed_at":"2026-08-06T15:20:38.621661Z","title":"Qingxiu Dong, Lei Li, Damai Dai, Ce Zheng, Jingyuan Ma, Rui Li, Heming Xia, Jingjing Xu, Zhiyong Wu, Tianyu Liu, et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-08T13:31:49.745762Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.621661Z"},"links":{"cited_paper":"/paper/2301.00234","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:e6ebf6ae42e763b720bf5c3fff4199f8ebabc3bbf93b53fa19a9db6402020416","observation_id":"9cb5e1ab-f374-4131-9d28-70fbe4026869","resolution":{"observed_at":"2026-08-06T15:20:38.621661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16926","last_updated":"2025-05-28T07:02:54Z","snapshot_observed_at":"2026-08-10T08:39:30.232881Z","submitted_at":"2024-12-22T08:55:19Z","title":"Revisiting In-Context Learning with Long Context Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16926","snapshot_observed_at":"2026-08-06T15:20:38.184876Z","title":"Revisit- ing in-context learning with long context language models.arXiv preprint arXiv:2412.16926,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-08T13:31:49.745762Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.184876Z"},"links":{"cited_paper":"/paper/2412.16926","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:168da1833e26e9a6de9e8bb5569d10591986a41ebb403cb43720cf9a84f0d153","observation_id":"ca0bdf73-0943-45c6-925d-1c0d4af84acd","resolution":{"observed_at":"2026-08-06T15:20:38.184876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.04835","last_updated":"2023-06-09T02:25:29Z","snapshot_observed_at":"2026-08-10T09:50:12.448542Z","submitted_at":"2023-05-08T16:32:18Z","title":"How Do In-Context Examples Affect Compositional Generalization?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.04835","snapshot_observed_at":"2026-08-06T15:20:38.084083Z","title":"How do in-context examples affect compositional generalization? arXiv preprint arXiv:2305.04835,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-08T13:31:49.745762Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.084083Z"},"links":{"cited_paper":"/paper/2305.04835","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:36a8488c5349298557aa6bf0cd0dec264cfd9ae740b407b4cd1ef6aa32fda5c8","observation_id":"456f5d0c-4ed0-4080-8f6c-4114818587dd","resolution":{"observed_at":"2026-08-06T15:20:38.084083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:39.352681Z","title":"Accessed: 2025-02-13","venue":null,"work_id":"2473feed-6c36-4479-92e3-ed676478025f","year":2025},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-08T13:31:49.745762Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.644765Z"},"links":{"citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:74e7179a6fb2371a14a0b716e38bdc6f920232f2dbe41484d35c90910ec5b400","observation_id":"72d0d03b-efb0-40e1-91c3-d98a02f68f2d","resolution":{"observed_at":"2026-08-06T15:20:39.356892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T13:31:49.745762Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":29,"verified_exact":1,"verified_fuzzy":10},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 0 inbound Pith citation observations for arXiv:2507.16217."}