{"as_of":"2026-08-18T04:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:37ce6f33eead6b46e055c3aeb0a7231d9b4ad208c220db2a2f0774a6db390897","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T12:06:23.550126Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:42:29.669246Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T15:42:33.153457Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"cited_work":{"arxiv_id":"2504.13835","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.13835","snapshot_observed_at":"2026-08-07T15:42:33.153457Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","venue":"cs.CL","work_id":"e3a7707b-00a0-413c-9824-72e8c754cf13","year":2025},"citing_paper":{"arxiv_id":"2505.17082","last_updated":"2025-05-20T12:38:42Z","snapshot_observed_at":"2026-08-16T03:55:53.831821Z","submitted_at":"2025-05-20T12:38:42Z","title":"GemMaroc: Unlocking Darija Proficiency in LLMs with Minimal Data","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:29.669246Z"},"links":{"cited_paper":"/paper/2504.13835","citing_paper":"/paper/2505.17082"},"observation_digest":"sha256:51a4b1f46e078fb4b7d9faaf18ea573ddec5e25f4a212e6d04b2a3d00e5e5dc0","observation_id":"dd426b84-2477-4009-bb0e-4e68d41d8de4","resolution":{"observed_at":"2026-08-07T15:42:33.224540Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2504.13835/citation-record","integrity":"/paper/2504.13835/integrity","json":"/paper/2504.13835/citation-record.json","paper":"/paper/2504.13835"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:23.400683Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.400683Z"},"links":{"citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:62818870c12fef6d52002f91a6a5716e8258ec8623da50587b65be3e70cca19d","observation_id":"1920f43a-0065-431c-8d44-73d2e799cac3","resolution":{"observed_at":"2026-08-16T12:06:23.400683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:23.404664Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.404664Z"},"links":{"citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:41fbcd088ad5e3ab22ed93d9efe98cf5ce92a3d0bed7e285e01637cd45c212af","observation_id":"1e074a3b-5062-4ad1-ac47-a3dfab47bc33","resolution":{"observed_at":"2026-08-16T12:06:23.404664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:23.947056Z","title":null,"venue":null,"work_id":"be21c73c-9761-4caf-b0e3-2713cf0f7864","year":2020},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.408858Z"},"links":{"citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:4b9e2ef216353f0bd0993e9dfb2de1217048b9173fe94131eac3345f40e802ca","observation_id":"a4f79338-c2b6-4a01-b148-f671a4e60db2","resolution":{"observed_at":"2026-08-16T12:06:23.949553Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:23.938281Z","title":null,"venue":null,"work_id":"c14dabe6-6772-43e4-a2db-b2a96e3235e3","year":2024},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.412139Z"},"links":{"citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:0976159318b093a245df3e1ce5e37c6394a71d11e80aadb422ecd5c96427f7f7","observation_id":"dffe31b0-1ce4-470b-8d9d-981521c85536","resolution":{"observed_at":"2026-08-16T12:06:23.940857Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.16256","last_updated":"2024-10-21T17:56:51Z","snapshot_observed_at":"2026-08-16T13:07:17.365456Z","submitted_at":"2024-10-21T17:56:51Z","title":"CompassJudger-1: All-in-one Judge Model Helps Model Evaluation and Evolution","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.16256","snapshot_observed_at":"2026-08-16T12:06:23.415897Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.415897Z"},"links":{"cited_paper":"/paper/2410.16256","citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:7b9e2371de04cb7c2ff4dcfa8609b9597dc552fafc6f171511f98fbaafc40545","observation_id":"cceb2006-6b67-4a31-9252-7381c1a11631","resolution":{"observed_at":"2026-08-16T12:06:23.415897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:23.931603Z","title":null,"venue":null,"work_id":"a45dc114-3756-4838-ab87-fb2c9f10ab83","year":2024},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.419370Z"},"links":{"citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:e58b72855ab7c3ed4275926d64a40a754fac73f39a75709631779f9a19dc3cef","observation_id":"e9a28bac-6aa0-437f-922d-69c0c54972a3","resolution":{"observed_at":"2026-08-16T12:06:23.934029Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:23.421956Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.421956Z"},"links":{"citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:d0a4ea73142faf6e973322c8bf1cb93cb7b72edee0470a40bd1401f85895e951","observation_id":"ded190e3-37cc-4de9-b9c0-23b4db27ec0f","resolution":{"observed_at":"2026-08-16T12:06:23.421956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-16T12:06:23.424358Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.424358Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:2932dfb7d587293d2d39453bb9262cf29510dd8071f5cad37b61524dbef905f7","observation_id":"cb130afd-af98-4d13-9a31-1bede424197c","resolution":{"observed_at":"2026-08-16T12:06:23.424358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:23.427460Z","title":"Gonzalez, Ion Stoica, and Eric P","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.427460Z"},"links":{"citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:ab9d7ab9a0cf0af2ea6eecc95a408e653c0ae468a7bc8a4a40dd627104581010","observation_id":"b88a9f00-6994-49ef-a73c-1d67ba4866a5","resolution":{"observed_at":"2026-08-16T12:06:23.427460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-08-14T19:36:07.505691Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-16T12:06:23.429829Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.429829Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:608c5797872aa714b77fc6bd653a1bbe68840eb6161ab78d01ffeb4606f27cac","observation_id":"3b5811c5-29a5-4135-a547-c606211b9350","resolution":{"observed_at":"2026-08-16T12:06:23.429829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-16T12:06:23.432490Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.432490Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:580fc1427be0c193489b1126018d2f506039029293ce9d57e2bae1b517a2e377","observation_id":"1bf6c7e0-f3f8-4452-9e2f-ceee2b58b272","resolution":{"observed_at":"2026-08-16T12:06:23.432490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:23.435273Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.435273Z"},"links":{"citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:025c4cb7fd81b2a467deb8d4b98eada85dfcb63ff04858fa6d471629c1603bc3","observation_id":"05de1ef2-7829-46c1-91c7-02c5f74452df","resolution":{"observed_at":"2026-08-16T12:06:23.435273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:23.913281Z","title":null,"venue":null,"work_id":"e33211a0-0628-4737-bb65-747cfa749f29","year":1983},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.437746Z"},"links":{"citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:d4feaeba6e40d9a4a9ede061b1a77a20fb9558fcf98502cc5582e3ac43f2945b","observation_id":"ad436ba4-d3f8-4323-802e-12a5d06bdc58","resolution":{"observed_at":"2026-08-16T12:06:23.916415Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:23.440346Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.440346Z"},"links":{"citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:00eb8d63ebb154dd93e5a310571b731962690b2b555e5fade3dc6b7fb2a0dd62","observation_id":"85e0c9b7-189e-44d4-95e9-5298f05a6ad0","resolution":{"observed_at":"2026-08-16T12:06:23.440346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:23.902197Z","title":null,"venue":null,"work_id":"7ef74970-69db-4c3d-a50c-05f6fb98e2b5","year":2024},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.442867Z"},"links":{"citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:32100c034d7a4ca5d17a132117cf035ba69a62991d5c02ebf90de1519f0dc5a8","observation_id":"3704d15d-60d8-4262-b793-a8557d0bf8e5","resolution":{"observed_at":"2026-08-16T12:06:23.904647Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.04475","last_updated":"2025-03-10T09:27:03Z","snapshot_observed_at":"2026-07-06T17:56:23.317089Z","submitted_at":"2024-04-06T02:29:02Z","title":"Length-Controlled AlpacaEval: A Simple Way to Debias Automatic Evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.04475","snapshot_observed_at":"2026-08-16T12:06:23.445282Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.445282Z"},"links":{"cited_paper":"/paper/2404.04475","citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:19dff2f7d209de74ee7c39ff3502304cb0d4ad17e351029e6cf1167331f97703","observation_id":"5cdf4f3b-4059-4f36-ac3b-b9d28e28dad4","resolution":{"observed_at":"2026-08-16T12:06:23.445282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:23.894622Z","title":null,"venue":null,"work_id":"5d754e8c-c1ac-4f35-b0a3-fb38e59f4ea7","year":2024},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.448859Z"},"links":{"citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:db204567cd0f9d173ba71bc80ab2a458e7c1c8bdbaf068c2fb166744e71f25ff","observation_id":"2dbf196d-3050-4ca1-bb98-56378ad5ee1f","resolution":{"observed_at":"2026-08-16T12:06:23.897715Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:23.886396Z","title":null,"venue":null,"work_id":"8c2c84a7-a086-4d2b-b063-01ce62fcc5c2","year":2019},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.452240Z"},"links":{"citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:5e4b8ffbb243827d5b9919c848e77b5661516624d307014bf4e3f55363c6868c","observation_id":"1ffdb354-21f8-4cd1-9c7f-d0139abd29c9","resolution":{"observed_at":"2026-08-16T12:06:23.889311Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:23.455296Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.455296Z"},"links":{"citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:ef3b86e6951af83854e38fde840852ca92ef4313f7efa789d1fc3372f5916a76","observation_id":"26159002-dfa7-4c3d-9196-6d22221fd03a","resolution":{"observed_at":"2026-08-16T12:06:23.455296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-08-17T20:30:34.016254Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-16T12:06:23.457785Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.457785Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:7b077e5bde971c36a89ce2cf058748eafbd45272158ec7d05b1d6ff9d0017868","observation_id":"1bfe70ce-b7ca-4f21-aeac-b9acc759079d","resolution":{"observed_at":"2026-08-16T12:06:23.457785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15124","last_updated":"2025-04-14T22:39:09Z","snapshot_observed_at":"2026-08-17T14:11:00.232598Z","submitted_at":"2024-11-22T18:44:04Z","title":"Tulu 3: Pushing Frontiers in Open Language Model Post-Training","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15124","snapshot_observed_at":"2026-08-16T12:06:23.460550Z","title":"Miranda, Alisa Liu, Nouha Dziri, Shane Lyu, Yuling Gu, Saumya Malik, Victoria Graf, Jena D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.460550Z"},"links":{"cited_paper":"/paper/2411.15124","citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:7a97d87c3ecb46dd46e5f12693b279eb7b940bbe38280e382c21d6f5d55beb7b","observation_id":"bfcd278f-9962-4437-b283-ac4a9f99aa85","resolution":{"observed_at":"2026-08-16T12:06:23.460550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:23.874547Z","title":null,"venue":null,"work_id":"3185fd82-ee2c-4c12-84c3-d8265b225a7a","year":2023},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.463494Z"},"links":{"citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:7543f9c184bb780b8ef55d1b9ee8c425e2e00fdfc022c23ca05d61d9acc14bd2","observation_id":"85443816-f651-4609-bc9c-15a2bd83efa4","resolution":{"observed_at":"2026-08-16T12:06:23.877208Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:23.867207Z","title":null,"venue":null,"work_id":"5a8efc2a-4254-44bd-a26c-51dd7a530798","year":2024},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.466063Z"},"links":{"citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:12dc3fc7f3fcda02455d00d408bd12e86360f6e2608e8e6fd36a286e7d49d198","observation_id":"d5d2904d-eaa6-4177-a46e-315b31717a31","resolution":{"observed_at":"2026-08-16T12:06:23.869925Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:23.858434Z","title":null,"venue":null,"work_id":"5aac66d5-41d1-48ad-8723-22dcc96666bb","year":2024},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.469114Z"},"links":{"citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:21f23162fd961fe5a10481fd9058f2e7b7cab8ced1f5ef09721697dd262e8a83","observation_id":"6e6ed22b-376d-470d-9a6f-173740942b77","resolution":{"observed_at":"2026-08-16T12:06:23.861294Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10302","last_updated":"2024-06-03T13:46:16Z","snapshot_observed_at":"2026-08-16T17:04:49.810665Z","submitted_at":"2023-12-16T03:33:12Z","title":"One-Shot Learning as Instruction Data Prospector for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10302","snapshot_observed_at":"2026-08-16T12:06:23.472225Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.472225Z"},"links":{"cited_paper":"/paper/2312.10302","citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:da80970281fb5919d952ff11064f4e5dbeafac18fdfb3628ceac9f2bb62a502a","observation_id":"eab152b1-ce95-484b-b482-9a1662880681","resolution":{"observed_at":"2026-08-16T12:06:23.472225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04770","last_updated":"2024-10-05T22:39:51Z","snapshot_observed_at":"2026-08-16T13:45:13.487794Z","submitted_at":"2024-06-07T09:15:44Z","title":"WildBench: Benchmarking LLMs with Challenging Tasks from Real Users in the Wild","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04770","snapshot_observed_at":"2026-08-16T12:06:23.475870Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.475870Z"},"links":{"cited_paper":"/paper/2406.04770","citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:434a9af1d33ad1f8ff10fc252fb56fc2fd7677f2f31925a0cc0b3394691cb07f","observation_id":"25fd77cb-bc41-4ff4-9caf-d3509714cc19","resolution":{"observed_at":"2026-08-16T12:06:23.475870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:23.848513Z","title":"Wong, Dongfang Li, Ziyi Wang, Baotian Hu, and Min Zhang","venue":null,"work_id":"b413ebb0-1899-40a9-9a8a-a6bbc45dae1f","year":2024},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.478923Z"},"links":{"citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:d050c6e69a0cdee4148b444488d826539a0b5b4897b6adb4a4bc600f9dbe8141","observation_id":"3fc2a3b4-8dc7-44da-b8bb-21dc14f3365c","resolution":{"observed_at":"2026-08-16T12:06:23.853018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:23.839996Z","title":null,"venue":null,"work_id":"ad4f45c9-a605-4fe1-ae12-6c5e6ec6a11f","year":2024},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.482139Z"},"links":{"citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:a81c6a00a8f0df5d3ba766cd08c5e2f0746fe1d6d8c1ade2d5e346380ace944f","observation_id":"d70e279e-4c71-45f7-a0e0-adfdf054c941","resolution":{"observed_at":"2026-08-16T12:06:23.843484Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:23.830914Z","title":null,"venue":null,"work_id":"3eb874a5-9134-429f-94af-41f726c2c6f0","year":2024},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.485128Z"},"links":{"citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:3140c3439989fdff2595fc13a6350953d1e8b293bda9dba01a1106cc5aa35b2a","observation_id":"75b45b42-0864-4a5d-9e01-624f5c0267a0","resolution":{"observed_at":"2026-08-16T12:06:23.834145Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:23.821803Z","title":null,"venue":null,"work_id":"8f3a4c13-ae45-4e20-b37c-f7458f5e2674","year":2005},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.488016Z"},"links":{"citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:67532b13fec33aa3ae6449873efb1125ef73fd36a4f89a5f3168757c6f90c952","observation_id":"3f06a365-ca02-4875-b71e-b16595ccb977","resolution":{"observed_at":"2026-08-16T12:06:23.824901Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:23.813201Z","title":null,"venue":null,"work_id":"674ff50f-d59c-4efc-9a79-cf831675fc2b","year":1978},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.491136Z"},"links":{"citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:6e56ddcbc9680045af41e9f136c4cc06b3e39c9695cebaf507160b241d984692","observation_id":"e21b2538-e695-411b-b612-7499f50027fc","resolution":{"observed_at":"2026-08-16T12:06:23.816171Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:23.494042Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.494042Z"},"links":{"citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:402c3471c753bc3ee685b41fd00e7231b044964a588f46f988869a8aebd34fd4","observation_id":"bc86a4fc-915b-488f-b266-b6589a0cc899","resolution":{"observed_at":"2026-08-16T12:06:23.494042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09261","last_updated":"2022-10-17T17:08:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-17T17:08:26Z","title":"Challenging BIG-Bench Tasks and Whether Chain-of-Thought Can Solve Them","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.09261","snapshot_observed_at":"2026-08-16T12:06:23.497019Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.497019Z"},"links":{"cited_paper":"/paper/2210.09261","citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:7351c3ae1db670d7df1d7ff6c5d9c9e6fd5da846fc05a28795bb95b9cfd74ce7","observation_id":"7867c7a8-2bc5-40d9-92e9-293fb68fe583","resolution":{"observed_at":"2026-08-16T12:06:23.497019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:23.500675Z","title":"Hashimoto","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.500675Z"},"links":{"citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:5e0d736eca3515af66e294341f6c54c923b06f968f7c55a228770293bacbbc5a","observation_id":"316a07e7-e405-410e-bbb3-7dc3d42838ec","resolution":{"observed_at":"2026-08-16T12:06:23.500675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:23.503611Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.503611Z"},"links":{"citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:12646c04f5118f8016c1b7e43d33c2a9a777a8ddeda96b104c6b0cd7f32dbe7f","observation_id":"2fc37dc7-5c0a-46c2-9eb4-a69ebb712e8d","resolution":{"observed_at":"2026-08-16T12:06:23.503611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-16T12:06:23.506240Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.506240Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:b300f3125f6710ad0e2ba244fc1ec9f13816eda6a9e4fc8372efda22df66e402","observation_id":"6c187cf9-ed5a-476c-a1e8-b071ddf93214","resolution":{"observed_at":"2026-08-16T12:06:23.506240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.11235","last_updated":"2024-03-16T04:32:25Z","snapshot_observed_at":"2026-08-18T02:33:26.792507Z","submitted_at":"2023-09-20T11:54:40Z","title":"OpenChat: Advancing Open-source Language Models with Mixed-Quality Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.11235","snapshot_observed_at":"2026-08-16T12:06:23.509174Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.509174Z"},"links":{"cited_paper":"/paper/2309.11235","citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:f7b398b29f96ef7ffbf364bf318841bfca5b6dcba76bf7ef368f37279d9c2882","observation_id":"44042f47-c56a-4a6c-860f-907d789aaebe","resolution":{"observed_at":"2026-08-16T12:06:23.509174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.00368","last_updated":"2024-05-31T07:22:01Z","snapshot_observed_at":"2026-08-16T14:30:41.754354Z","submitted_at":"2023-12-31T02:13:18Z","title":"Improving Text Embeddings with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.00368","snapshot_observed_at":"2026-08-16T12:06:23.512268Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.512268Z"},"links":{"cited_paper":"/paper/2401.00368","citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:acdfc19423997ed00b9481fdf026d36b7d2897ca42b71b431801328227c63181","observation_id":"eee0d688-d9b8-460e-8079-6e83d9f2c8b1","resolution":{"observed_at":"2026-08-16T12:06:23.512268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02318","last_updated":"2024-02-04T02:09:43Z","snapshot_observed_at":"2026-08-17T04:12:23.348318Z","submitted_at":"2024-02-04T02:09:43Z","title":"Diversity Measurement and Subset Selection for Instruction Tuning Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02318","snapshot_observed_at":"2026-08-16T12:06:23.515888Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.515888Z"},"links":{"cited_paper":"/paper/2402.02318","citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:020a930cc34c8dbf5cbcd2acc5cafe51af10b0311dbbcd151a59e6d1a9b2792a","observation_id":"947900c1-ab11-43c5-a3c5-42e006ef94d6","resolution":{"observed_at":"2026-08-16T12:06:23.515888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.08182","last_updated":"2023-11-14T14:10:40Z","snapshot_observed_at":"2026-08-16T14:43:25.931867Z","submitted_at":"2023-11-14T14:10:40Z","title":"Self-Evolved Diverse Data Sampling for Efficient Instruction Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.08182","snapshot_observed_at":"2026-08-16T12:06:23.518985Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.518985Z"},"links":{"cited_paper":"/paper/2311.08182","citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:df59edea4c732fb8e881e7d33d37341d00126470a474fce98172e27808114def","observation_id":"fbeaefb3-8554-4e02-af17-101f03abebdd","resolution":{"observed_at":"2026-08-16T12:06:23.518985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:23.787084Z","title":null,"venue":null,"work_id":"20ecd93b-7e78-4cb1-a6af-ebac2e74f445","year":2024},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.521752Z"},"links":{"citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:207dcbeebbca13fa673d0421928521bc3cb20db7a667db63705e3a715d63edd9","observation_id":"71942dfb-a88f-42a6-b997-acabaafedf3e","resolution":{"observed_at":"2026-08-16T12:06:23.791147Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09335","last_updated":"2024-12-09T09:31:39Z","snapshot_observed_at":"2026-08-16T13:10:08.134780Z","submitted_at":"2024-10-12T02:48:34Z","title":"Rethinking Data Selection at Scale: Random Selection is Almost All You Need","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09335","snapshot_observed_at":"2026-08-16T12:06:23.524506Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.524506Z"},"links":{"cited_paper":"/paper/2410.09335","citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:259206d1c3924cf6594ebc68318b870447004cb5024aeabd106fb94e5f3626f3","observation_id":"d288b5a2-d972-4b20-9360-0bbb23961bca","resolution":{"observed_at":"2026-08-16T12:06:23.524506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-08-17T18:50:07.059564Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-16T12:06:23.527276Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.527276Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:2c189df74769d0fc9e26d7f4287bea46ddd8f99972d640fbcb61fe3e6ffd4849","observation_id":"9efced55-d50f-400e-a205-d2899bac41d2","resolution":{"observed_at":"2026-08-16T12:06:23.527276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06645","last_updated":"2024-07-11T03:06:45Z","snapshot_observed_at":"2026-08-16T22:28:42.649286Z","submitted_at":"2024-07-09T08:14:29Z","title":"Entropy Law: The Story Behind Data Compression and LLM Performance","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.06645","snapshot_observed_at":"2026-08-16T12:06:23.529686Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.529686Z"},"links":{"cited_paper":"/paper/2407.06645","citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:1544ebab7f3aa446e9e515cfb4bb08a447ae9dbac75551771474dc024fbd346a","observation_id":"af33c2c4-9b9f-4699-8789-205c87ece905","resolution":{"observed_at":"2026-08-16T12:06:23.529686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:23.777502Z","title":null,"venue":null,"work_id":"2fbfeca2-ab42-4439-9a8f-9608d54f6054","year":2024},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.533253Z"},"links":{"citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:147d8364e168a1fcadcbc889fd836d51dc0052fb399db750ba5868aacd32d55a","observation_id":"5d52e863-2b68-4c15-8c4a-1f30823a7812","resolution":{"observed_at":"2026-08-16T12:06:23.780432Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.11378","last_updated":"2024-09-17T17:25:31Z","snapshot_observed_at":"2026-08-16T13:17:44.670607Z","submitted_at":"2024-09-17T17:25:31Z","title":"Diversify and Conquer: Diversity-Centric Data Selection with Iterative Refinement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.11378","snapshot_observed_at":"2026-08-16T12:06:23.535762Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.535762Z"},"links":{"cited_paper":"/paper/2409.11378","citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:6aec8fa39c1ce395b9de47466c780ec7234be1bd5b261287135cc423ff6ad387","observation_id":"0cb175b2-97b8-40b7-b202-5987a529a53a","resolution":{"observed_at":"2026-08-16T12:06:23.535762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:23.767456Z","title":"Zhang, and Yongbin Li","venue":null,"work_id":"0a140899-3592-498f-9c36-7801991ce3a4","year":2024},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.538346Z"},"links":{"citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:fd73a46174820915565d1afa610ac4e5b61b346cdabe90ec265176f572ac32c3","observation_id":"13fbecb1-f800-49ed-a143-3f9983774dbb","resolution":{"observed_at":"2026-08-16T12:06:23.771060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:23.756380Z","title":"Gonzalez, and Ion Stoica","venue":null,"work_id":"53a8de6e-b71c-4a1c-b2cb-6f190af05631","year":2023},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.540695Z"},"links":{"citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:b0c77403ef4b9595c2ff3d2311409d9feac45bb2d02ffea25864d3a8f05bf821","observation_id":"ae3618c5-9b9f-4340-a254-363c3b1bb39f","resolution":{"observed_at":"2026-08-16T12:06:23.759713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:23.746798Z","title":null,"venue":null,"work_id":"74d71b76-facd-4b74-bb01-f0088c2647c9","year":2024},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.543753Z"},"links":{"citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:8068c25dd26106d7b8eed6836edbb3c6827709c24866bc5fce445db4c044e597","observation_id":"d4e25908-a7b2-4fa2-9b90-3b94805d16d9","resolution":{"observed_at":"2026-08-16T12:06:23.749695Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:06:23.736834Z","title":null,"venue":null,"work_id":"1ed61cbf-d452-4d0a-a92f-d0ce173a1c04","year":2023},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.546732Z"},"links":{"citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:79003a0b6800d3bac07507b5f9c4a7a9e46257e80ce8ad7e6e110278872ad564","observation_id":"6225b090-ce0b-4fec-b779-003fb40f1c7d","resolution":{"observed_at":"2026-08-16T12:06:23.740513Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07911","last_updated":"2023-11-14T05:13:55Z","snapshot_observed_at":"2026-07-06T16:47:08.877195Z","submitted_at":"2023-11-14T05:13:55Z","title":"Instruction-Following Evaluation for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07911","snapshot_observed_at":"2026-08-16T12:06:23.550126Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-16T12:06:23.550126Z"},"links":{"cited_paper":"/paper/2311.07911","citing_paper":"/paper/2504.13835"},"observation_digest":"sha256:992e16583e017841eadf9737afd533407ea58bdd3f5c240d5c3b844730e17d87","observation_id":"66ecf3c9-272a-486f-97b3-e97d552aa0cd","resolution":{"observed_at":"2026-08-16T12:06:23.550126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2504.13835","last_updated":"2025-04-18T17:59:46Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-18T02:33:56.062083Z","submitted_at":"2025-04-18T17:59:46Z","title":"MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":48,"verified_exact":0,"verified_fuzzy":3},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 1 inbound Pith citation observation for arXiv:2504.13835."}