{"as_of":"2026-08-16T23:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9ee047afb5fd3624d950dead737f57b2b87a3bc84b14f9b1756142814379657f","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:42:57.326630Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:42:22.425017Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-14T19:17:50.815149Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.12212","last_updated":"2025-06-01T05:57:00Z","snapshot_observed_at":"2026-08-16T05:47:52.816756Z","submitted_at":"2025-05-18T03:10:00Z","title":"Data Whisperer: Efficient Data Selection for Task-Specific LLM Fine-Tuning via Few-Shot In-Context Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.12212","snapshot_observed_at":"2026-08-07T04:42:22.425017Z","title":"Data whisperer: Efficient data selection for task-specific llm fine-tuning via few-shot in-context learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10100","last_updated":"2025-06-11T18:34:57Z","snapshot_observed_at":"2026-08-08T23:31:58.329673Z","submitted_at":"2025-06-11T18:34:57Z","title":"EfficientVLA: Training-Free Acceleration and Compression for Vision-Language-Action Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T04:42:22.425017Z"},"links":{"cited_paper":"/paper/2505.12212","citing_paper":"/paper/2506.10100"},"observation_digest":"sha256:2186f50d167f7ae28f1752e68685bd2883b15e8f42dff1939e76b1ee8b9384d8","observation_id":"743d6ac6-6307-475b-b850-00e59b1f09ba","resolution":{"observed_at":"2026-08-07T04:42:22.425017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.12212","last_updated":"2025-06-01T05:57:00Z","snapshot_observed_at":"2026-08-16T05:47:52.816756Z","submitted_at":"2025-05-18T03:10:00Z","title":"Data Whisperer: Efficient Data Selection for Task-Specific LLM Fine-Tuning via Few-Shot In-Context Learning","version":3},"cited_work":{"arxiv_id":"2505.12212","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.12212","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Data whisperer: Efficient data selection for task- specific llm fine-tuning via few-shot in-context learning","venue":null,"work_id":"27c496e5-6e11-4db3-b983-8b96cb787e51","year":2025},"citing_paper":{"arxiv_id":"2604.11810","last_updated":"2026-04-09T14:08:01Z","snapshot_observed_at":"2026-08-15T10:56:18.827013Z","submitted_at":"2026-04-09T14:08:01Z","title":"GRACE: A Dynamic Coreset Selection Framework for Large Language Model Optimization","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-10T18:06:46.131725Z"},"links":{"cited_paper":"/paper/2505.12212","citing_paper":"/paper/2604.11810"},"observation_digest":"sha256:01d44a1cb428f46e481b8f133b5d607739af637e3f0a9d0adf5a9e9c5bf8750e","observation_id":"2bda6020-f87e-4539-8292-d32e86e34f35","resolution":{"observed_at":"2026-05-11T05:30:57.964680Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.12212","last_updated":"2025-06-01T05:57:00Z","snapshot_observed_at":"2026-08-16T05:47:52.816756Z","submitted_at":"2025-05-18T03:10:00Z","title":"Data Whisperer: Efficient Data Selection for Task-Specific LLM Fine-Tuning via Few-Shot In-Context Learning","version":3},"cited_work":{"arxiv_id":"2505.12212","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.12212","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Data whisperer: Efficient data selection for task- specific llm fine-tuning via few-shot in-context learning","venue":null,"work_id":"27c496e5-6e11-4db3-b983-8b96cb787e51","year":2025},"citing_paper":{"arxiv_id":"2605.13375","last_updated":"2026-05-13T11:32:03Z","snapshot_observed_at":"2026-08-11T15:02:05.500337Z","submitted_at":"2026-05-13T11:32:03Z","title":"GRIP-VLM: Group-Relative Importance Pruning for Efficient Vision-Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-14T19:15:13.205594Z"},"links":{"cited_paper":"/paper/2505.12212","citing_paper":"/paper/2605.13375"},"observation_digest":"sha256:9f354f0ec69d5cee8364da044093500947ba3388c331f0dc29a8964525d7cab7","observation_id":"62663dba-f79a-442d-b3fa-bbb6a665b7db","resolution":{"observed_at":"2026-05-14T19:17:50.819402Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.12212/citation-record","integrity":"/paper/2505.12212/integrity","json":"/paper/2505.12212/citation-record.json","paper":"/paper/2505.12212"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:57.645866Z","title":null,"venue":null,"work_id":"366dbda4-e638-45a0-8d62-81ca0456e698","year":null},"citing_paper":{"arxiv_id":"2505.12212","last_updated":"2025-06-01T05:57:00Z","snapshot_observed_at":"2026-08-16T05:47:52.816756Z","submitted_at":"2025-05-18T03:10:00Z","title":"Data Whisperer: Efficient Data Selection for Task-Specific LLM Fine-Tuning via Few-Shot In-Context Learning","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T20:42:57.258803Z"},"links":{"citing_paper":"/paper/2505.12212"},"observation_digest":"sha256:f5a222a7d2f861450386698e55c2b43e17a1e3c33a0c9662ceef23e3e2f23cd8","observation_id":"2be52288-bbc4-4088-a0de-bc6d986ddec0","resolution":{"observed_at":"2026-08-15T20:42:57.649639Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-15T20:42:57.224370Z","title":"Damai Dai, Yutao Sun, Li Dong, Yaru Hao, Shuming Ma, Zhifang Sui, and Furu Wei","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.12212","last_updated":"2025-06-01T05:57:00Z","snapshot_observed_at":"2026-08-16T05:47:52.816756Z","submitted_at":"2025-05-18T03:10:00Z","title":"Data Whisperer: Efficient Data Selection for Task-Specific LLM Fine-Tuning via Few-Shot In-Context Learning","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T20:42:57.224370Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2505.12212"},"observation_digest":"sha256:d11e6dbe706c6c31af9956ad7909481e9b1bacdf1482c1d75d3bc7a709a221c3","observation_id":"b1a400cd-f554-4748-a043-dbdeb7058444","resolution":{"observed_at":"2026-08-15T20:42:57.224370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.14215","last_updated":"2022-10-25T17:57:49Z","snapshot_observed_at":"2026-08-16T16:21:13.318476Z","submitted_at":"2022-10-25T17:57:49Z","title":"In-context Reinforcement Learning with Algorithm Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.14215","snapshot_observed_at":"2026-08-15T20:42:57.229434Z","title":"InInternational Conference on Machine Learning, pages 5464–5474","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.12212","last_updated":"2025-06-01T05:57:00Z","snapshot_observed_at":"2026-08-16T05:47:52.816756Z","submitted_at":"2025-05-18T03:10:00Z","title":"Data Whisperer: Efficient Data Selection for Task-Specific LLM Fine-Tuning via Few-Shot In-Context Learning","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T20:42:57.229434Z"},"links":{"cited_paper":"/paper/2210.14215","citing_paper":"/paper/2505.12212"},"observation_digest":"sha256:2ae910cb64c717db4d9db5921da59f1bc97d9840d5bdb13c81e575ca06f49b87","observation_id":"b8df1d10-35b3-46aa-80bc-cf8342a7f0f5","resolution":{"observed_at":"2026-08-15T20:42:57.229434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:57.607148Z","title":"Please answer each question step by step and provide the final answer following the instructions below","venue":null,"work_id":"073f5e44-3d42-4b11-8e3c-a6dbbba86595","year":null},"citing_paper":{"arxiv_id":"2505.12212","last_updated":"2025-06-01T05:57:00Z","snapshot_observed_at":"2026-08-16T05:47:52.816756Z","submitted_at":"2025-05-18T03:10:00Z","title":"Data Whisperer: Efficient Data Selection for Task-Specific LLM Fine-Tuning via Few-Shot In-Context Learning","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T20:42:57.272780Z"},"links":{"citing_paper":"/paper/2505.12212"},"observation_digest":"sha256:763cacaed002fc76a9a1e709af6d4f615991bd1558372b4d089b722a1c4da1e0","observation_id":"3da34d51-8e37-41a4-b5f9-521ab7877fd6","resolution":{"observed_at":"2026-08-15T20:42:57.612096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:57.429632Z","title":"dialogue","venue":null,"work_id":"e9053bed-9f95-4be2-a755-dc49716c6b9b","year":null},"citing_paper":{"arxiv_id":"2505.12212","last_updated":"2025-06-01T05:57:00Z","snapshot_observed_at":"2026-08-16T05:47:52.816756Z","submitted_at":"2025-05-18T03:10:00Z","title":"Data Whisperer: Efficient Data Selection for Task-Specific LLM Fine-Tuning via Few-Shot In-Context Learning","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T20:42:57.326630Z"},"links":{"citing_paper":"/paper/2505.12212"},"observation_digest":"sha256:6273c40f303df1f129fcdb7ba88589ec0473c9fdd8b8b9f1c73772f77f989be0","observation_id":"da7894d2-8988-4599-b826-2a843810cea3","resolution":{"observed_at":"2026-08-15T20:42:57.434927Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13372","last_updated":"2024-06-27T22:44:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-20T08:08:54Z","title":"LlamaFactory: Unified Efficient Fine-Tuning of 100+ Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13372","snapshot_observed_at":"2026-08-15T20:42:57.254132Z","title":"Generate a concise summary of the dialogue","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12212","last_updated":"2025-06-01T05:57:00Z","snapshot_observed_at":"2026-08-16T05:47:52.816756Z","submitted_at":"2025-05-18T03:10:00Z","title":"Data Whisperer: Efficient Data Selection for Task-Specific LLM Fine-Tuning via Few-Shot In-Context Learning","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T20:42:57.254132Z"},"links":{"cited_paper":"/paper/2403.13372","citing_paper":"/paper/2505.12212"},"observation_digest":"sha256:0d84b1c613a62ce66ad441ff3cf0f16a891eb24beb5a3453147888555b385810","observation_id":"2415dc86-d8ff-4546-bc50-6edb5e9cfe6a","resolution":{"observed_at":"2026-08-15T20:42:57.254132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:57.630957Z","title":"Replace `<number>` with the correct final result (either an integer or a floating - point number)","venue":null,"work_id":"72989139-ce84-4817-9fb4-275dc4543269","year":null},"citing_paper":{"arxiv_id":"2505.12212","last_updated":"2025-06-01T05:57:00Z","snapshot_observed_at":"2026-08-16T05:47:52.816756Z","submitted_at":"2025-05-18T03:10:00Z","title":"Data Whisperer: Efficient Data Selection for Task-Specific LLM Fine-Tuning via Few-Shot In-Context Learning","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T20:42:57.263489Z"},"links":{"citing_paper":"/paper/2505.12212"},"observation_digest":"sha256:cccfc397d646ea6511b5f4ec2818359a049650ed0402d3bd0521e3108f8980d0","observation_id":"fb1fc68a-b948-42ef-a181-a8511750b2c9","resolution":{"observed_at":"2026-08-15T20:42:57.635920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:57.268096Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.12212","last_updated":"2025-06-01T05:57:00Z","snapshot_observed_at":"2026-08-16T05:47:52.816756Z","submitted_at":"2025-05-18T03:10:00Z","title":"Data Whisperer: Efficient Data Selection for Task-Specific LLM Fine-Tuning via Few-Shot In-Context Learning","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T20:42:57.268096Z"},"links":{"citing_paper":"/paper/2505.12212"},"observation_digest":"sha256:eb02221b24ee0d1523690e44e4e07dbbff670abc3da8821c4f77f246c40d62c5","observation_id":"8c012d33-3963-41c8-bac7-bbbdb8cad640","resolution":{"observed_at":"2026-08-15T20:42:57.268096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:57.593142Z","title":"The medium bed can house 3 rows with 20 seeds being sown per row, so that's 3*20 = <<3*20=60>>60 seeds","venue":null,"work_id":"85d62b75-0d17-4d54-b7e0-6d5c7640b25a","year":null},"citing_paper":{"arxiv_id":"2505.12212","last_updated":"2025-06-01T05:57:00Z","snapshot_observed_at":"2026-08-16T05:47:52.816756Z","submitted_at":"2025-05-18T03:10:00Z","title":"Data Whisperer: Efficient Data Selection for Task-Specific LLM Fine-Tuning via Few-Shot In-Context Learning","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T20:42:57.277763Z"},"links":{"citing_paper":"/paper/2505.12212"},"observation_digest":"sha256:3ce709b2997c52d1b16c706866ef46c8b7614147ce136d4c6d9c6901f88abb26","observation_id":"a1cfa76f-0a2e-4010-8f78-6592e3a7d530","resolution":{"observed_at":"2026-08-15T20:42:57.597806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:57.578663Z","title":null,"venue":null,"work_id":"45a13b94-231d-4070-a2b6-78ef5b839dca","year":null},"citing_paper":{"arxiv_id":"2505.12212","last_updated":"2025-06-01T05:57:00Z","snapshot_observed_at":"2026-08-16T05:47:52.816756Z","submitted_at":"2025-05-18T03:10:00Z","title":"Data Whisperer: Efficient Data Selection for Task-Specific LLM Fine-Tuning via Few-Shot In-Context Learning","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T20:42:57.282817Z"},"links":{"citing_paper":"/paper/2505.12212"},"observation_digest":"sha256:ca78d502939f4b97888ef0fc767fa46b4f5c19b2b705ba2ce30db9fba3424926","observation_id":"1f57ca02-17dc-4453-a607-da77e3a9d2cb","resolution":{"observed_at":"2026-08-15T20:42:57.583550Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:57.286722Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.12212","last_updated":"2025-06-01T05:57:00Z","snapshot_observed_at":"2026-08-16T05:47:52.816756Z","submitted_at":"2025-05-18T03:10:00Z","title":"Data Whisperer: Efficient Data Selection for Task-Specific LLM Fine-Tuning via Few-Shot In-Context Learning","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T20:42:57.286722Z"},"links":{"citing_paper":"/paper/2505.12212"},"observation_digest":"sha256:b7c7db773032ed6364907290c4ee29ae6c898d6546e104bfdb79c692e59d1427","observation_id":"4ef01f4d-dd05-48da-96b6-ae681d56f909","resolution":{"observed_at":"2026-08-15T20:42:57.286722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:57.555919Z","title":"Given a specific healthcare topic or issue, explain potential ethical considerations and implications","venue":null,"work_id":"2cb1b446-c2b7-4d2c-a61a-fc231e666290","year":null},"citing_paper":{"arxiv_id":"2505.12212","last_updated":"2025-06-01T05:57:00Z","snapshot_observed_at":"2026-08-16T05:47:52.816756Z","submitted_at":"2025-05-18T03:10:00Z","title":"Data Whisperer: Efficient Data Selection for Task-Specific LLM Fine-Tuning via Few-Shot In-Context Learning","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T20:42:57.290573Z"},"links":{"citing_paper":"/paper/2505.12212"},"observation_digest":"sha256:8aa490bb26545d8bb040bb2a9f8c452ef2adec3b137f692a9e090f587e9dcc03","observation_id":"165cafa4-957c-493c-a9fc-204dd96146e5","resolution":{"observed_at":"2026-08-15T20:42:57.560241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:57.294493Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.12212","last_updated":"2025-06-01T05:57:00Z","snapshot_observed_at":"2026-08-16T05:47:52.816756Z","submitted_at":"2025-05-18T03:10:00Z","title":"Data Whisperer: Efficient Data Selection for Task-Specific LLM Fine-Tuning via Few-Shot In-Context Learning","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T20:42:57.294493Z"},"links":{"citing_paper":"/paper/2505.12212"},"observation_digest":"sha256:9649de946a488c7e4a1d6c57f65032413b23b79b4aba0d99b0afddca4bb2a4dc","observation_id":"ecf31cbd-efa4-4b8c-9b60-e7e9fa5b1413","resolution":{"observed_at":"2026-08-15T20:42:57.294493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:57.298296Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.12212","last_updated":"2025-06-01T05:57:00Z","snapshot_observed_at":"2026-08-16T05:47:52.816756Z","submitted_at":"2025-05-18T03:10:00Z","title":"Data Whisperer: Efficient Data Selection for Task-Specific LLM Fine-Tuning via Few-Shot In-Context Learning","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T20:42:57.298296Z"},"links":{"citing_paper":"/paper/2505.12212"},"observation_digest":"sha256:1dc10084ab04e11f9a21ac451150f9c398509589d73c5b03ca5751d331da9d16","observation_id":"eaf80d1a-0b02-435c-bcdb-9f61f3403091","resolution":{"observed_at":"2026-08-15T20:42:57.298296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:57.520606Z","title":"No valid content to summarize","venue":null,"work_id":"2325c514-eded-403b-baa0-771436d9e963","year":null},"citing_paper":{"arxiv_id":"2505.12212","last_updated":"2025-06-01T05:57:00Z","snapshot_observed_at":"2026-08-16T05:47:52.816756Z","submitted_at":"2025-05-18T03:10:00Z","title":"Data Whisperer: Efficient Data Selection for Task-Specific LLM Fine-Tuning via Few-Shot In-Context Learning","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T20:42:57.302097Z"},"links":{"citing_paper":"/paper/2505.12212"},"observation_digest":"sha256:9c01cf535b81de0cd883bcfe4c84511692f81c655c2e8f07752c3dfe5dfd99b3","observation_id":"4d7db35b-d7a5-43d6-9782-ef8f262712e0","resolution":{"observed_at":"2026-08-15T20:42:57.525721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:57.504203Z","title":"Dialogue 2:","venue":null,"work_id":"91225f26-eb6f-4b89-ab58-4467c098ee2e","year":1960},"citing_paper":{"arxiv_id":"2505.12212","last_updated":"2025-06-01T05:57:00Z","snapshot_observed_at":"2026-08-16T05:47:52.816756Z","submitted_at":"2025-05-18T03:10:00Z","title":"Data Whisperer: Efficient Data Selection for Task-Specific LLM Fine-Tuning via Few-Shot In-Context Learning","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T20:42:57.305823Z"},"links":{"citing_paper":"/paper/2505.12212"},"observation_digest":"sha256:d55a21c7f83b39534c97dea696fb96efadbf39c4333855a1f6a6b2820458a3f8","observation_id":"60270600-0b60-4f7d-b76b-836fa0793e21","resolution":{"observed_at":"2026-08-15T20:42:57.509168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:57.488116Z","title":"Ensure the dialogue is meaningful and engaging","venue":null,"work_id":"579e7d8c-105c-4d9b-ba6a-061720709046","year":null},"citing_paper":{"arxiv_id":"2505.12212","last_updated":"2025-06-01T05:57:00Z","snapshot_observed_at":"2026-08-16T05:47:52.816756Z","submitted_at":"2025-05-18T03:10:00Z","title":"Data Whisperer: Efficient Data Selection for Task-Specific LLM Fine-Tuning via Few-Shot In-Context Learning","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T20:42:57.309832Z"},"links":{"citing_paper":"/paper/2505.12212"},"observation_digest":"sha256:608e1ca2c6c35d0343bf7510575964eb9b73449fed9ab045c709db45a6951012","observation_id":"2af050d5-e5b5-44cd-aadb-dee67be3aa22","resolution":{"observed_at":"2026-08-15T20:42:57.493373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:57.473628Z","title":null,"venue":null,"work_id":"011fe1f4-bc97-42fe-9f00-2ab1368ad124","year":null},"citing_paper":{"arxiv_id":"2505.12212","last_updated":"2025-06-01T05:57:00Z","snapshot_observed_at":"2026-08-16T05:47:52.816756Z","submitted_at":"2025-05-18T03:10:00Z","title":"Data Whisperer: Efficient Data Selection for Task-Specific LLM Fine-Tuning via Few-Shot In-Context Learning","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T20:42:57.313551Z"},"links":{"citing_paper":"/paper/2505.12212"},"observation_digest":"sha256:87d8c0a984283b670a63148ae91581e30525c1ffc6952392c4fa9acf2c89d829","observation_id":"936adffb-d604-4c87-b612-e68083fc2537","resolution":{"observed_at":"2026-08-15T20:42:57.478032Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:57.458824Z","title":"No valid content to summarize","venue":null,"work_id":"506e1c84-d423-4871-8dd9-5a77f9d93e14","year":null},"citing_paper":{"arxiv_id":"2505.12212","last_updated":"2025-06-01T05:57:00Z","snapshot_observed_at":"2026-08-16T05:47:52.816756Z","submitted_at":"2025-05-18T03:10:00Z","title":"Data Whisperer: Efficient Data Selection for Task-Specific LLM Fine-Tuning via Few-Shot In-Context Learning","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T20:42:57.318020Z"},"links":{"citing_paper":"/paper/2505.12212"},"observation_digest":"sha256:c22effa038c466c4e78b485b4b088f36fb2223da80ab96415da8afc9371fa7a7","observation_id":"dbf067d9-d5f4-431c-afd6-129299ec1840","resolution":{"observed_at":"2026-08-15T20:42:57.463271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:57.444922Z","title":null,"venue":null,"work_id":"76017d96-1972-4793-b277-5d69bc03666b","year":null},"citing_paper":{"arxiv_id":"2505.12212","last_updated":"2025-06-01T05:57:00Z","snapshot_observed_at":"2026-08-16T05:47:52.816756Z","submitted_at":"2025-05-18T03:10:00Z","title":"Data Whisperer: Efficient Data Selection for Task-Specific LLM Fine-Tuning via Few-Shot In-Context Learning","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T20:42:57.322391Z"},"links":{"citing_paper":"/paper/2505.12212"},"observation_digest":"sha256:7e49745d6d2eaabf5c7d9d7643dbc552a6e2b1f63e368a9d24734d5a9a788c0c","observation_id":"97f2fe74-c147-4f38-a012-a59d66d03e18","resolution":{"observed_at":"2026-08-15T20:42:57.449228Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16938","last_updated":"2023-05-30T08:34:49Z","snapshot_observed_at":"2026-08-16T15:29:18.851413Z","submitted_at":"2023-05-26T13:55:17Z","title":"Few-shot Fine-tuning vs. In-context Learning: A Fair Comparison and Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16938","snapshot_observed_at":"2026-08-15T20:42:57.234372Z","title":"InInternational Conference on Machine Learning, pages 6950–6960","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12212","last_updated":"2025-06-01T05:57:00Z","snapshot_observed_at":"2026-08-16T05:47:52.816756Z","submitted_at":"2025-05-18T03:10:00Z","title":"Data Whisperer: Efficient Data Selection for Task-Specific LLM Fine-Tuning via Few-Shot In-Context Learning","version":3},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-15T20:42:57.234372Z"},"links":{"cited_paper":"/paper/2305.16938","citing_paper":"/paper/2505.12212"},"observation_digest":"sha256:a7073d7552f3162954d62cbe80198e0586bfe38a0249ba44d18237adb85be2f3","observation_id":"129819cc-b5ff-447d-83d3-d455730845b2","resolution":{"observed_at":"2026-08-15T20:42:57.234372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:57.686380Z","title":"InFindings of the Association for Computational Linguistics: ACL-IJCNLP 2021, pages 5062–5074, Online","venue":null,"work_id":"8c0f61c4-9dd7-4ee8-b246-f4b0041ecf74","year":2021},"citing_paper":{"arxiv_id":"2505.12212","last_updated":"2025-06-01T05:57:00Z","snapshot_observed_at":"2026-08-16T05:47:52.816756Z","submitted_at":"2025-05-18T03:10:00Z","title":"Data Whisperer: Efficient Data Selection for Task-Specific LLM Fine-Tuning via Few-Shot In-Context Learning","version":3},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-15T20:42:57.218783Z"},"links":{"citing_paper":"/paper/2505.12212"},"observation_digest":"sha256:d4b846e75e3ec6b83384539e11f36dae4e307c9edcbca61d09cea255d632f539","observation_id":"7576a535-0120-465b-87e1-f45e27b0f7d1","resolution":{"observed_at":"2026-08-15T20:42:57.691249Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:57.671849Z","title":"Mansheej Paul, Surya Ganguli, and Gintare Karolina Dziugaite","venue":null,"work_id":"3b1cd7c9-ba83-4d6e-b30f-8b83e57d39fc","year":2021},"citing_paper":{"arxiv_id":"2505.12212","last_updated":"2025-06-01T05:57:00Z","snapshot_observed_at":"2026-08-16T05:47:52.816756Z","submitted_at":"2025-05-18T03:10:00Z","title":"Data Whisperer: Efficient Data Selection for Task-Specific LLM Fine-Tuning via Few-Shot In-Context Learning","version":3},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-15T20:42:57.239460Z"},"links":{"citing_paper":"/paper/2505.12212"},"observation_digest":"sha256:875a99c7cc4c38e2d4a7decc7b14abc348d626fc077694d82aade234a8a7a6df","observation_id":"aaf6c3c7-f388-4e86-a12e-d0af10728a70","resolution":{"observed_at":"2026-08-15T20:42:57.676137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:57.658779Z","title":"InThe Eleventh International Confer- ence on Learning Representations","venue":null,"work_id":"539684f8-693e-4e08-8976-4315c4832ffd","year":null},"citing_paper":{"arxiv_id":"2505.12212","last_updated":"2025-06-01T05:57:00Z","snapshot_observed_at":"2026-08-16T05:47:52.816756Z","submitted_at":"2025-05-18T03:10:00Z","title":"Data Whisperer: Efficient Data Selection for Task-Specific LLM Fine-Tuning via Few-Shot In-Context Learning","version":3},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-15T20:42:57.249670Z"},"links":{"citing_paper":"/paper/2505.12212"},"observation_digest":"sha256:71fa5370d151e0dd783c6baf6a401535de1332cfd03a88fe462da29a090ffcc5","observation_id":"c2fd7e13-1738-4f80-a2df-0807b7e776b9","resolution":{"observed_at":"2026-08-15T20:42:57.662866Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07827","last_updated":"2024-02-12T17:34:13Z","snapshot_observed_at":"2026-08-16T14:19:15.735686Z","submitted_at":"2024-02-12T17:34:13Z","title":"Aya Model: An Instruction Finetuned Open-Access Multilingual Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07827","snapshot_observed_at":"2026-08-15T20:42:57.244230Z","title":"Ahmet Üstün, Viraat Aryabumi, Zheng-Xin Yong, Wei- Yin Ko, Daniel D’souza, Gbemileke Onilude, Neel Bhandari, Shivalika Singh, Hui-Lee Ooi, Amr Kayid, et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12212","last_updated":"2025-06-01T05:57:00Z","snapshot_observed_at":"2026-08-16T05:47:52.816756Z","submitted_at":"2025-05-18T03:10:00Z","title":"Data Whisperer: Efficient Data Selection for Task-Specific LLM Fine-Tuning via Few-Shot In-Context Learning","version":3},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-15T20:42:57.244230Z"},"links":{"cited_paper":"/paper/2402.07827","citing_paper":"/paper/2505.12212"},"observation_digest":"sha256:a16ec530c53b3e0e3cea9f62ad2f0f6393df13085405d48559f2c4a13896a6ef","observation_id":"a42fd6d8-772a-4ddf-848b-0e5a7fdd20a4","resolution":{"observed_at":"2026-08-15T20:42:57.244230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.12212","last_updated":"2025-06-01T05:57:00Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-16T05:47:52.816756Z","submitted_at":"2025-05-18T03:10:00Z","title":"Data Whisperer: Efficient Data Selection for Task-Specific LLM Fine-Tuning via Few-Shot In-Context Learning"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":0,"verified_fuzzy":11},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 3 inbound Pith citation observations for arXiv:2505.12212."}