{"as_of":"2026-08-18T05:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2e2458c9535e45139e210587db28af04c5c0bd597e0c1f8b7fd101d034ac2572","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T16:30:22.533521Z","state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.10008/citation-record","integrity":"/paper/2412.10008/integrity","json":"/paper/2412.10008/citation-record.json","paper":"/paper/2412.10008"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:30:22.437622Z","title":"Aguda, Suchetha Siddagangappa, Elena Kochkina, Simerjot Kaur, Dongsheng Wang, and Charese Smiley","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10008","last_updated":"2024-12-13T09:47:26Z","snapshot_observed_at":"2026-08-17T12:10:08.482948Z","submitted_at":"2024-12-13T09:47:26Z","title":"Automated Collection of Evaluation Dataset for Semantic Search in Low-Resource Domain Language","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T16:30:22.437622Z"},"links":{"citing_paper":"/paper/2412.10008"},"observation_digest":"sha256:ccee3fe2b5f8eeda41e21fc2600055478d4b5d16c49a4de2aa3e2a492683cf0d","observation_id":"4cf659a8-1b75-4a17-bfcc-58a27419974f","resolution":{"observed_at":"2026-08-11T16:30:22.437622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.22932","last_updated":"2024-11-01T12:37:10Z","snapshot_observed_at":"2026-08-16T13:04:35.280532Z","submitted_at":"2024-10-30T11:38:13Z","title":"Multi-Agent Large Language Models for Conversational Task-Solving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.22932","snapshot_observed_at":"2026-08-11T16:30:22.441802Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10008","last_updated":"2024-12-13T09:47:26Z","snapshot_observed_at":"2026-08-17T12:10:08.482948Z","submitted_at":"2024-12-13T09:47:26Z","title":"Automated Collection of Evaluation Dataset for Semantic Search in Low-Resource Domain Language","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T16:30:22.441802Z"},"links":{"cited_paper":"/paper/2410.22932","citing_paper":"/paper/2412.10008"},"observation_digest":"sha256:6c411c5296fd772d7426d378ddd09cb7c282306e3f5603d0d93f60f278fb6b63","observation_id":"48294da8-065a-4f97-a4f1-22c241b26a98","resolution":{"observed_at":"2026-08-11T16:30:22.441802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:30:22.836934Z","title":null,"venue":null,"work_id":"d3fd25a9-78de-4e06-8848-465a89e6713d","year":2018},"citing_paper":{"arxiv_id":"2412.10008","last_updated":"2024-12-13T09:47:26Z","snapshot_observed_at":"2026-08-17T12:10:08.482948Z","submitted_at":"2024-12-13T09:47:26Z","title":"Automated Collection of Evaluation Dataset for Semantic Search in Low-Resource Domain Language","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T16:30:22.445833Z"},"links":{"citing_paper":"/paper/2412.10008"},"observation_digest":"sha256:ebb045db9d92231bf8d4bd0a10d10f0fc696e790f5c34e3aa6e625e4e92df3cd","observation_id":"795bedc7-9b3e-4709-8fd0-bda80e4dfaea","resolution":{"observed_at":"2026-08-11T16:30:22.840422Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13006","last_updated":"2024-11-01T23:48:45Z","snapshot_observed_at":"2026-08-16T13:08:40.186203Z","submitted_at":"2024-10-16T20:03:51Z","title":"LLM Chain Ensembles for Scalable and Accurate Data Annotation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13006","snapshot_observed_at":"2026-08-11T16:30:22.450068Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10008","last_updated":"2024-12-13T09:47:26Z","snapshot_observed_at":"2026-08-17T12:10:08.482948Z","submitted_at":"2024-12-13T09:47:26Z","title":"Automated Collection of Evaluation Dataset for Semantic Search in Low-Resource Domain Language","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T16:30:22.450068Z"},"links":{"cited_paper":"/paper/2410.13006","citing_paper":"/paper/2412.10008"},"observation_digest":"sha256:4c65da676a640ab6983dba385393516389a7ab07f375d4077f3f8525c9850cdd","observation_id":"c7d7a7c2-ef57-458c-85a8-1257be0b4027","resolution":{"observed_at":"2026-08-11T16:30:22.450068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:30:22.456955Z","title":"Hedderich, Lukas Lange, Heike Adel, Jannik Str \\\"o tgen, and Dietrich Klakow","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.10008","last_updated":"2024-12-13T09:47:26Z","snapshot_observed_at":"2026-08-17T12:10:08.482948Z","submitted_at":"2024-12-13T09:47:26Z","title":"Automated Collection of Evaluation Dataset for Semantic Search in Low-Resource Domain Language","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T16:30:22.456955Z"},"links":{"citing_paper":"/paper/2412.10008"},"observation_digest":"sha256:a1279216c8627da4ab5294d376982e8dd0acacd9de98a3e34db209df0dcb64dd","observation_id":"80966bcc-e2fe-4ac2-a0f0-7085fe21ec4a","resolution":{"observed_at":"2026-08-11T16:30:22.456955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:30:22.827177Z","title":"Krippendorff","venue":null,"work_id":"23f4d0d1-80a1-4348-9ad2-43167e68a0a2","year":2013},"citing_paper":{"arxiv_id":"2412.10008","last_updated":"2024-12-13T09:47:26Z","snapshot_observed_at":"2026-08-17T12:10:08.482948Z","submitted_at":"2024-12-13T09:47:26Z","title":"Automated Collection of Evaluation Dataset for Semantic Search in Low-Resource Domain Language","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T16:30:22.461323Z"},"links":{"citing_paper":"/paper/2412.10008"},"observation_digest":"sha256:8451508d565599c5b108e77886bb089089f71648d88362686de43ab2ab5e6d9b","observation_id":"0af8fbaa-127b-436a-b2f7-68ec8784ebc9","resolution":{"observed_at":"2026-08-11T16:30:22.830561Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.06093","last_updated":"2024-08-05T15:51:50Z","snapshot_observed_at":"2026-08-16T13:53:55.346304Z","submitted_at":"2024-05-09T20:45:58Z","title":"Selective Fine-tuning on LLM-labeled Data May Reduce Reliance on Human Annotation: A Case Study Using Schedule-of-Event Table Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.06093","snapshot_observed_at":"2026-08-11T16:30:22.465616Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10008","last_updated":"2024-12-13T09:47:26Z","snapshot_observed_at":"2026-08-17T12:10:08.482948Z","submitted_at":"2024-12-13T09:47:26Z","title":"Automated Collection of Evaluation Dataset for Semantic Search in Low-Resource Domain Language","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T16:30:22.465616Z"},"links":{"cited_paper":"/paper/2405.06093","citing_paper":"/paper/2412.10008"},"observation_digest":"sha256:3cb380198d3b801af5fae597ecf8451e7e69dfb80c5bf3abb1c9ab427d47c654","observation_id":"89477fc3-11f3-42a8-a811-c541506c073d","resolution":{"observed_at":"2026-08-11T16:30:22.465616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:30:22.469727Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.10008","last_updated":"2024-12-13T09:47:26Z","snapshot_observed_at":"2026-08-17T12:10:08.482948Z","submitted_at":"2024-12-13T09:47:26Z","title":"Automated Collection of Evaluation Dataset for Semantic Search in Low-Resource Domain Language","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T16:30:22.469727Z"},"links":{"citing_paper":"/paper/2412.10008"},"observation_digest":"sha256:b1bb5181b3b4b46acee60e60abce4c00ee685a9c8cff0673c56e5737a83abb85","observation_id":"47222702-dd73-4560-8edf-8d99db05224f","resolution":{"observed_at":"2026-08-11T16:30:22.469727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:30:22.816904Z","title":"Tamer Zsu","venue":null,"work_id":"59e4cef2-aa5f-4955-be22-c384879c0189","year":2009},"citing_paper":{"arxiv_id":"2412.10008","last_updated":"2024-12-13T09:47:26Z","snapshot_observed_at":"2026-08-17T12:10:08.482948Z","submitted_at":"2024-12-13T09:47:26Z","title":"Automated Collection of Evaluation Dataset for Semantic Search in Low-Resource Domain Language","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T16:30:22.476216Z"},"links":{"citing_paper":"/paper/2412.10008"},"observation_digest":"sha256:9d451f7d349f9ff3a346dcc65bb72e307758506d1fadc0d5dea18f5037e53d55","observation_id":"c99cc547-382e-4d33-ba1d-de2e14f8b1b5","resolution":{"observed_at":"2026-08-11T16:30:22.820308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.09825","last_updated":"2023-11-16T11:51:13Z","snapshot_observed_at":"2026-08-18T04:57:39.236635Z","submitted_at":"2023-11-16T11:51:13Z","title":"Human Still Wins over LLM: An Empirical Study of Active Learning on Domain-Specific Annotation Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.09825","snapshot_observed_at":"2026-08-11T16:30:22.480773Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.10008","last_updated":"2024-12-13T09:47:26Z","snapshot_observed_at":"2026-08-17T12:10:08.482948Z","submitted_at":"2024-12-13T09:47:26Z","title":"Automated Collection of Evaluation Dataset for Semantic Search in Low-Resource Domain Language","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T16:30:22.480773Z"},"links":{"cited_paper":"/paper/2311.09825","citing_paper":"/paper/2412.10008"},"observation_digest":"sha256:fce9d4cadb23bb4fae3366ae9a7153613fb4e28782e6a5205c0f8f042cbe2420","observation_id":"3d783413-7cd2-4b4c-8f47-1dc292be4a48","resolution":{"observed_at":"2026-08-11T16:30:22.480773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:30:22.484982Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.10008","last_updated":"2024-12-13T09:47:26Z","snapshot_observed_at":"2026-08-17T12:10:08.482948Z","submitted_at":"2024-12-13T09:47:26Z","title":"Automated Collection of Evaluation Dataset for Semantic Search in Low-Resource Domain Language","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T16:30:22.484982Z"},"links":{"citing_paper":"/paper/2412.10008"},"observation_digest":"sha256:c79493f66f5e328bf0c2d7ef57daf405ff514522f4238d615263631a7214ff30","observation_id":"0922651c-03f7-4b8a-8d88-9ea2d15b9651","resolution":{"observed_at":"2026-08-11T16:30:22.484982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00176","last_updated":"2023-05-31T20:50:45Z","snapshot_observed_at":"2026-08-16T15:27:45.321805Z","submitted_at":"2023-05-31T20:50:45Z","title":"Automated Annotation with Generative AI Requires Validation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00176","snapshot_observed_at":"2026-08-11T16:30:22.489474Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.10008","last_updated":"2024-12-13T09:47:26Z","snapshot_observed_at":"2026-08-17T12:10:08.482948Z","submitted_at":"2024-12-13T09:47:26Z","title":"Automated Collection of Evaluation Dataset for Semantic Search in Low-Resource Domain Language","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T16:30:22.489474Z"},"links":{"cited_paper":"/paper/2306.00176","citing_paper":"/paper/2412.10008"},"observation_digest":"sha256:aeb53d945852f2fd2ef7c68181417888919cd4b8d21d8b5396e3d84f2b05005d","observation_id":"0b82be27-fdae-42b4-91c7-0abbf4d4a42e","resolution":{"observed_at":"2026-08-11T16:30:22.489474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02563","last_updated":"2024-08-24T14:46:55Z","snapshot_observed_at":"2026-08-16T14:21:40.155375Z","submitted_at":"2024-02-04T16:45:01Z","title":"Synergy-of-Thoughts: Eliciting Efficient Reasoning in Hybrid Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02563","snapshot_observed_at":"2026-08-11T16:30:22.493452Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10008","last_updated":"2024-12-13T09:47:26Z","snapshot_observed_at":"2026-08-17T12:10:08.482948Z","submitted_at":"2024-12-13T09:47:26Z","title":"Automated Collection of Evaluation Dataset for Semantic Search in Low-Resource Domain Language","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T16:30:22.493452Z"},"links":{"cited_paper":"/paper/2402.02563","citing_paper":"/paper/2412.10008"},"observation_digest":"sha256:d7acd7629dbff1079a75a9de10d83ce3f55e35ed605cc2d1fa7a89ca2cbde259","observation_id":"4346be21-a1bc-4769-ba57-d22cdd125e61","resolution":{"observed_at":"2026-08-11T16:30:22.493452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.36190/2023.15","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:30:22.588969Z","title":null,"venue":null,"work_id":"c2c175d5-b3c8-49e1-94fa-28f313612b4a","year":2023},"citing_paper":{"arxiv_id":"2412.10008","last_updated":"2024-12-13T09:47:26Z","snapshot_observed_at":"2026-08-17T12:10:08.482948Z","submitted_at":"2024-12-13T09:47:26Z","title":"Automated Collection of Evaluation Dataset for Semantic Search in Low-Resource Domain Language","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T16:30:22.497056Z"},"links":{"citing_paper":"/paper/2412.10008"},"observation_digest":"sha256:13214e5bcf118768f62d61cb2f397e6cba695b93c63c8b03331f94116a5b24e8","observation_id":"153aa202-a5ef-4072-951a-7aa640c5c3cc","resolution":{"observed_at":"2026-08-11T16:30:22.593030Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12954","last_updated":"2024-01-23T18:22:19Z","snapshot_observed_at":"2026-08-18T03:58:58.973947Z","submitted_at":"2024-01-23T18:22:19Z","title":"Meta-Prompting: Enhancing Language Models with Task-Agnostic Scaffolding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12954","snapshot_observed_at":"2026-08-11T16:30:22.501246Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10008","last_updated":"2024-12-13T09:47:26Z","snapshot_observed_at":"2026-08-17T12:10:08.482948Z","submitted_at":"2024-12-13T09:47:26Z","title":"Automated Collection of Evaluation Dataset for Semantic Search in Low-Resource Domain Language","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T16:30:22.501246Z"},"links":{"cited_paper":"/paper/2401.12954","citing_paper":"/paper/2412.10008"},"observation_digest":"sha256:6cf1c1dab70dcb8a4d5abe5ebb693f4a2be59c0b464f69c8d8318ad9c23421d9","observation_id":"7e9cee2c-a15a-4f3a-953f-40b7f58380af","resolution":{"observed_at":"2026-08-11T16:30:22.501246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13446","last_updated":"2024-12-02T20:55:15Z","snapshot_observed_at":"2026-08-16T14:16:46.810700Z","submitted_at":"2024-02-21T00:44:04Z","title":"Large Language Models for Data Annotation and Synthesis: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13446","snapshot_observed_at":"2026-08-11T16:30:22.505212Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10008","last_updated":"2024-12-13T09:47:26Z","snapshot_observed_at":"2026-08-17T12:10:08.482948Z","submitted_at":"2024-12-13T09:47:26Z","title":"Automated Collection of Evaluation Dataset for Semantic Search in Low-Resource Domain Language","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T16:30:22.505212Z"},"links":{"cited_paper":"/paper/2402.13446","citing_paper":"/paper/2412.10008"},"observation_digest":"sha256:a8df6acf17975706b67d8c29daf1cbd75c5c7e699fbe3d3985faa27342a87cd3","observation_id":"fcd1d65c-d6c5-4294-8010-747bbf543cf5","resolution":{"observed_at":"2026-08-11T16:30:22.505212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05672","last_updated":"2024-02-08T13:47:50Z","snapshot_observed_at":"2026-08-12T15:58:37.148545Z","submitted_at":"2024-02-08T13:47:50Z","title":"Multilingual E5 Text Embeddings: A Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05672","snapshot_observed_at":"2026-08-11T16:30:22.508809Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10008","last_updated":"2024-12-13T09:47:26Z","snapshot_observed_at":"2026-08-17T12:10:08.482948Z","submitted_at":"2024-12-13T09:47:26Z","title":"Automated Collection of Evaluation Dataset for Semantic Search in Low-Resource Domain Language","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T16:30:22.508809Z"},"links":{"cited_paper":"/paper/2402.05672","citing_paper":"/paper/2412.10008"},"observation_digest":"sha256:e4d67cae0a1329209f1b3e5ac77ed6b212d02f54d8f6c23823179ebc14c77faf","observation_id":"6b5489a6-dfa0-4ded-b6d0-0d6103627efb","resolution":{"observed_at":"2026-08-11T16:30:22.508809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:30:22.805379Z","title":"Yang, Damian Dailisan, Marcin Korecki, Carina I","venue":null,"work_id":"d53326df-9fa9-4ac7-9e42-c91282484ccf","year":2024},"citing_paper":{"arxiv_id":"2412.10008","last_updated":"2024-12-13T09:47:26Z","snapshot_observed_at":"2026-08-17T12:10:08.482948Z","submitted_at":"2024-12-13T09:47:26Z","title":"Automated Collection of Evaluation Dataset for Semantic Search in Low-Resource Domain Language","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T16:30:22.512268Z"},"links":{"citing_paper":"/paper/2412.10008"},"observation_digest":"sha256:eb2127ce64774f04b2a2ac7e37579249fb38b9469bbc665ad95211dd6a1416c7","observation_id":"859ac94b-1b80-45a3-853f-a0a3fdcc58de","resolution":{"observed_at":"2026-08-11T16:30:22.809279Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:30:22.515749Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.10008","last_updated":"2024-12-13T09:47:26Z","snapshot_observed_at":"2026-08-17T12:10:08.482948Z","submitted_at":"2024-12-13T09:47:26Z","title":"Automated Collection of Evaluation Dataset for Semantic Search in Low-Resource Domain Language","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T16:30:22.515749Z"},"links":{"citing_paper":"/paper/2412.10008"},"observation_digest":"sha256:bb09658c99c8faf313723d5d74e95229b5b09087e0b8ded946606ccb8bcf8716","observation_id":"5ff9e7d6-cafe-4618-a0ef-67545359bb78","resolution":{"observed_at":"2026-08-11T16:30:22.515749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10145","last_updated":"2023-04-22T08:55:33Z","snapshot_observed_at":"2026-08-17T14:45:26.211282Z","submitted_at":"2023-04-20T08:08:12Z","title":"Can ChatGPT Reproduce Human-Generated Labels? A Study of Social Computing Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10145","snapshot_observed_at":"2026-08-11T16:30:22.518930Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.10008","last_updated":"2024-12-13T09:47:26Z","snapshot_observed_at":"2026-08-17T12:10:08.482948Z","submitted_at":"2024-12-13T09:47:26Z","title":"Automated Collection of Evaluation Dataset for Semantic Search in Low-Resource Domain Language","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T16:30:22.518930Z"},"links":{"cited_paper":"/paper/2304.10145","citing_paper":"/paper/2412.10008"},"observation_digest":"sha256:7ea632a38f3839f3e57de27dd230f7d49b8270cd318b617e1bc086d83a208bab","observation_id":"21f4ddc2-9d6c-4550-9cce-1dd4b25464ce","resolution":{"observed_at":"2026-08-11T16:30:22.518930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:30:22.795308Z","title":null,"venue":null,"work_id":"309d1b96-df7b-4d15-9d23-d462ec21cc43","year":2021},"citing_paper":{"arxiv_id":"2412.10008","last_updated":"2024-12-13T09:47:26Z","snapshot_observed_at":"2026-08-17T12:10:08.482948Z","submitted_at":"2024-12-13T09:47:26Z","title":"Automated Collection of Evaluation Dataset for Semantic Search in Low-Resource Domain Language","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T16:30:22.522899Z"},"links":{"citing_paper":"/paper/2412.10008"},"observation_digest":"sha256:842bb779a16b68bba66696e34914182b5a6fb31989363116eb86ff60492c31b6","observation_id":"1b5ff4b6-4782-4b68-9488-3859c2c174fe","resolution":{"observed_at":"2026-08-11T16:30:22.798823Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s10115-024-02212-5","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:30:22.565677Z","title":"Matt, and Bela Gipp","venue":null,"work_id":"8dee47af-ef07-4c51-9f0f-e577059a9014","year":2024},"citing_paper":{"arxiv_id":"2412.10008","last_updated":"2024-12-13T09:47:26Z","snapshot_observed_at":"2026-08-17T12:10:08.482948Z","submitted_at":"2024-12-13T09:47:26Z","title":"Automated Collection of Evaluation Dataset for Semantic Search in Low-Resource Domain Language","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T16:30:22.526363Z"},"links":{"citing_paper":"/paper/2412.10008"},"observation_digest":"sha256:dd2eefc65eedbfc7b2eac6e866e353ca042f0979aeff446bf5df01c57961e4bd","observation_id":"77d34aba-66e4-40bc-be03-344170707b88","resolution":{"observed_at":"2026-08-11T16:30:22.570752Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:30:22.529713Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.10008","last_updated":"2024-12-13T09:47:26Z","snapshot_observed_at":"2026-08-17T12:10:08.482948Z","submitted_at":"2024-12-13T09:47:26Z","title":"Automated Collection of Evaluation Dataset for Semantic Search in Low-Resource Domain Language","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T16:30:22.529713Z"},"links":{"citing_paper":"/paper/2412.10008"},"observation_digest":"sha256:763cfbbedf0543f296d5e207814be8cb7749fbed51a77a53c0943e07b80c727b","observation_id":"4ba8ed82-4d29-4e8e-b2b1-e5db1fefe414","resolution":{"observed_at":"2026-08-11T16:30:22.529713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:30:22.533521Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.10008","last_updated":"2024-12-13T09:47:26Z","snapshot_observed_at":"2026-08-17T12:10:08.482948Z","submitted_at":"2024-12-13T09:47:26Z","title":"Automated Collection of Evaluation Dataset for Semantic Search in Low-Resource Domain Language","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T16:30:22.533521Z"},"links":{"citing_paper":"/paper/2412.10008"},"observation_digest":"sha256:6c7d762eaa9f054f26dac839d3fd4ead62816577e80c9e2f5737f1918c8f5ae6","observation_id":"36502eac-2f74-4bf9-b563-1d62c813a974","resolution":{"observed_at":"2026-08-11T16:30:22.533521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.10008","last_updated":"2024-12-13T09:47:26Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-17T12:10:08.482948Z","submitted_at":"2024-12-13T09:47:26Z","title":"Automated Collection of Evaluation Dataset for Semantic Search in Low-Resource Domain Language"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":2,"verified_fuzzy":3},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 0 inbound Pith citation observations for arXiv:2412.10008."}