{"as_of":"2026-08-17T01:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2ac93a09080e493a94dff32aee0c80c61f09cd048b5dafee79b302ca1f4da701","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T22:20:24.771947Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.07179/citation-record","integrity":"/paper/2508.07179/integrity","json":"/paper/2508.07179/citation-record.json","paper":"/paper/2508.07179"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:20:25.583692Z","title":null,"venue":null,"work_id":"585e8216-efb6-48d1-95e5-8c0e1f8a88d9","year":2016},"citing_paper":{"arxiv_id":"2508.07179","last_updated":"2025-08-10T05:04:32Z","snapshot_observed_at":"2026-08-16T17:21:52.192023Z","submitted_at":"2025-08-10T05:04:32Z","title":"Schema Lineage Extraction at Scale: Multilingual Pipelines, Composite Evaluation, and Language-Model Benchmarks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T22:20:24.590960Z"},"links":{"citing_paper":"/paper/2508.07179"},"observation_digest":"sha256:cdfbd68a0dcea11aca5385c164e86006cffef5ee83e241f882c91e8c1e73ae58","observation_id":"93805bac-4946-4d8b-9f73-dbcef33e6bad","resolution":{"observed_at":"2026-08-05T22:20:25.587937Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s00778-002-0083-8","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Cui and J","venue":"The VLDB Journal","work_id":"d0d307cb-06c4-41c8-a0b1-2303f909cfca","year":2003},"citing_paper":{"arxiv_id":"2508.07179","last_updated":"2025-08-10T05:04:32Z","snapshot_observed_at":"2026-08-16T17:21:52.192023Z","submitted_at":"2025-08-10T05:04:32Z","title":"Schema Lineage Extraction at Scale: Multilingual Pipelines, Composite Evaluation, and Language-Model Benchmarks","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T22:20:24.595989Z"},"links":{"citing_paper":"/paper/2508.07179"},"observation_digest":"sha256:8490429c794c08761c5e08ed801d91b4ae927e953034ef7a792892196a1a518a","observation_id":"b32bf9c3-a97e-45b5-bef6-662d5597f99e","resolution":{"observed_at":"2026-08-05T22:20:24.838437Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-05T22:20:24.600692Z","title":"Evaluating large language models trained on code, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.07179","last_updated":"2025-08-10T05:04:32Z","snapshot_observed_at":"2026-08-16T17:21:52.192023Z","submitted_at":"2025-08-10T05:04:32Z","title":"Schema Lineage Extraction at Scale: Multilingual Pipelines, Composite Evaluation, and Language-Model Benchmarks","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T22:20:24.600692Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2508.07179"},"observation_digest":"sha256:0a45b59b5dc8447ce14422aea21dbd30001a63f40c570b73a84f5de64ffc51fd","observation_id":"96d57aa9-bdb4-4e43-9268-8b7dffa1c636","resolution":{"observed_at":"2026-08-05T22:20:24.600692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07258","last_updated":"2022-07-12T23:45:14Z","snapshot_observed_at":"2026-08-02T09:20:40.804790Z","submitted_at":"2021-08-16T17:50:08Z","title":"On the Opportunities and Risks of Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07258","snapshot_observed_at":"2026-08-05T22:20:24.606536Z","title":"Hudson, Ehsan Adeli, Russ Altman, Simran Arora, Sydney von Arx, et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.07179","last_updated":"2025-08-10T05:04:32Z","snapshot_observed_at":"2026-08-16T17:21:52.192023Z","submitted_at":"2025-08-10T05:04:32Z","title":"Schema Lineage Extraction at Scale: Multilingual Pipelines, Composite Evaluation, and Language-Model Benchmarks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T22:20:24.606536Z"},"links":{"cited_paper":"/paper/2108.07258","citing_paper":"/paper/2508.07179"},"observation_digest":"sha256:346633bab99962ed5b069d3fdd125a9cbee83661dc9f5a3497cbcbc3d23515b7","observation_id":"d0d7dd87-43b1-4028-aa86-a9a0c48d9368","resolution":{"observed_at":"2026-08-05T22:20:24.606536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.11401","last_updated":"2021-04-12T15:42:18Z","snapshot_observed_at":"2026-08-07T05:44:30.677502Z","submitted_at":"2020-05-22T21:34:34Z","title":"Retrieval-Augmented Generation for Knowledge-Intensive NLP Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.11401","snapshot_observed_at":"2026-08-05T22:20:24.611597Z","title":"Retrieval-augmented generation for knowledge-intensive nlp tasks, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.07179","last_updated":"2025-08-10T05:04:32Z","snapshot_observed_at":"2026-08-16T17:21:52.192023Z","submitted_at":"2025-08-10T05:04:32Z","title":"Schema Lineage Extraction at Scale: Multilingual Pipelines, Composite Evaluation, and Language-Model Benchmarks","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T22:20:24.611597Z"},"links":{"cited_paper":"/paper/2005.11401","citing_paper":"/paper/2508.07179"},"observation_digest":"sha256:5afb2416fb80b88689473d0cb9840e24f03da8826c5166046929ac9f8a0e8b8a","observation_id":"e3a8f375-666f-4072-b193-4f1b86a5f3c5","resolution":{"observed_at":"2026-08-05T22:20:24.611597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05856","last_updated":"2024-01-11T12:04:11Z","snapshot_observed_at":"2026-08-16T14:28:14.835680Z","submitted_at":"2024-01-11T12:04:11Z","title":"Seven Failure Points When Engineering a Retrieval Augmented Generation System","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.05856","snapshot_observed_at":"2026-08-05T22:20:24.616921Z","title":"Seven failure points when engineering a retrieval augmented generation system, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07179","last_updated":"2025-08-10T05:04:32Z","snapshot_observed_at":"2026-08-16T17:21:52.192023Z","submitted_at":"2025-08-10T05:04:32Z","title":"Schema Lineage Extraction at Scale: Multilingual Pipelines, Composite Evaluation, and Language-Model Benchmarks","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T22:20:24.616921Z"},"links":{"cited_paper":"/paper/2401.05856","citing_paper":"/paper/2508.07179"},"observation_digest":"sha256:e27ad059ba4dbb4872c73da88795027c1c5225c8a022077d0e5bddcce2ac9a18","observation_id":"5eedf284-f840-4a1d-a462-6eca40e8d869","resolution":{"observed_at":"2026-08-05T22:20:24.616921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s00778-011-0231-0","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"SCOPE: parallel databases meet MapReduce.VLDB Journal, 21(5):611–636, 2012","venue":"The VLDB Journal","work_id":"63d21848-101e-4081-881a-09d6ebf79c8e","year":2012},"citing_paper":{"arxiv_id":"2508.07179","last_updated":"2025-08-10T05:04:32Z","snapshot_observed_at":"2026-08-16T17:21:52.192023Z","submitted_at":"2025-08-10T05:04:32Z","title":"Schema Lineage Extraction at Scale: Multilingual Pipelines, Composite Evaluation, and Language-Model Benchmarks","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T22:20:24.622536Z"},"links":{"citing_paper":"/paper/2508.07179"},"observation_digest":"sha256:5b2066b696d4806b97a8fdce88e2c9e80f75d38ceedf42ad157675225b978db1","observation_id":"b2d145ab-6824-4eaa-bffe-1f8cbb7c1f05","resolution":{"observed_at":"2026-08-05T22:20:24.821936Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T22:20:24.626764Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.07179","last_updated":"2025-08-10T05:04:32Z","snapshot_observed_at":"2026-08-16T17:21:52.192023Z","submitted_at":"2025-08-10T05:04:32Z","title":"Schema Lineage Extraction at Scale: Multilingual Pipelines, Composite Evaluation, and Language-Model Benchmarks","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T22:20:24.626764Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2508.07179"},"observation_digest":"sha256:05106836ac7cb8d6f604dd24f7f98095acbd30001bbf7986615aa18c97fe3150","observation_id":"de066ba2-322e-4031-a696-6f62440cf4a9","resolution":{"observed_at":"2026-08-05T22:20:24.626764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.10297","last_updated":"2020-09-27T04:07:11Z","snapshot_observed_at":"2026-08-12T14:26:33.940158Z","submitted_at":"2020-09-22T03:10:49Z","title":"CodeBLEU: a Method for Automatic Evaluation of Code Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.10297","snapshot_observed_at":"2026-08-05T22:20:24.631692Z","title":"URLhttps://arxiv.org/abs/2009.10297","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.07179","last_updated":"2025-08-10T05:04:32Z","snapshot_observed_at":"2026-08-16T17:21:52.192023Z","submitted_at":"2025-08-10T05:04:32Z","title":"Schema Lineage Extraction at Scale: Multilingual Pipelines, Composite Evaluation, and Language-Model Benchmarks","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T22:20:24.631692Z"},"links":{"cited_paper":"/paper/2009.10297","citing_paper":"/paper/2508.07179"},"observation_digest":"sha256:ddf04b8258ccd316d145c880eee734b836ee1db69ab74dea9d5ad25cff8b7dc1","observation_id":"976e18e6-e663-4177-8842-763f0dc3c644","resolution":{"observed_at":"2026-08-05T22:20:24.631692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:20:25.570549Z","title":null,"venue":null,"work_id":"882f924e-6003-47f3-aaae-75de838c7361","year":1966},"citing_paper":{"arxiv_id":"2508.07179","last_updated":"2025-08-10T05:04:32Z","snapshot_observed_at":"2026-08-16T17:21:52.192023Z","submitted_at":"2025-08-10T05:04:32Z","title":"Schema Lineage Extraction at Scale: Multilingual Pipelines, Composite Evaluation, and Language-Model Benchmarks","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T22:20:24.636419Z"},"links":{"citing_paper":"/paper/2508.07179"},"observation_digest":"sha256:95c8bd50eb80a44803b984389aec9b626e849e17d022cff45709a253c84036f3","observation_id":"06efd464-7642-4dbb-bdb3-d63287caf23c","resolution":{"observed_at":"2026-08-05T22:20:25.574865Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:20:24.640702Z","title":"Bleu: a method for automatic evaluation of machine translation","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2508.07179","last_updated":"2025-08-10T05:04:32Z","snapshot_observed_at":"2026-08-16T17:21:52.192023Z","submitted_at":"2025-08-10T05:04:32Z","title":"Schema Lineage Extraction at Scale: Multilingual Pipelines, Composite Evaluation, and Language-Model Benchmarks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T22:20:24.640702Z"},"links":{"citing_paper":"/paper/2508.07179"},"observation_digest":"sha256:8e921b19a481f204bd00ed5aeebb304d7c6d0e31d2e6e4221d905ec00edab818","observation_id":"6c4e5fae-13b7-4dec-97bd-a4acdbc56389","resolution":{"observed_at":"2026-08-05T22:20:24.640702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:20:25.558029Z","title":null,"venue":null,"work_id":"6e046407-9f38-4656-9f91-0e94bf2cee3b","year":2023},"citing_paper":{"arxiv_id":"2508.07179","last_updated":"2025-08-10T05:04:32Z","snapshot_observed_at":"2026-08-16T17:21:52.192023Z","submitted_at":"2025-08-10T05:04:32Z","title":"Schema Lineage Extraction at Scale: Multilingual Pipelines, Composite Evaluation, and Language-Model Benchmarks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T22:20:24.645833Z"},"links":{"citing_paper":"/paper/2508.07179"},"observation_digest":"sha256:7bbeea9e26289761f473d02ae15e95ef7287b8cf32dd16dadb65944ca2fa3098","observation_id":"debac25a-ecaa-4b60-a0a3-98387c061a19","resolution":{"observed_at":"2026-08-05T22:20:25.562031Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.06180","last_updated":"2023-09-12T12:50:04Z","snapshot_observed_at":"2026-08-02T09:51:08.145755Z","submitted_at":"2023-09-12T12:50:04Z","title":"Efficient Memory Management for Large Language Model Serving with PagedAttention","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.06180","snapshot_observed_at":"2026-08-05T22:20:24.650356Z","title":"Efficient memory management for large language model serving with pagedattention, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.07179","last_updated":"2025-08-10T05:04:32Z","snapshot_observed_at":"2026-08-16T17:21:52.192023Z","submitted_at":"2025-08-10T05:04:32Z","title":"Schema Lineage Extraction at Scale: Multilingual Pipelines, Composite Evaluation, and Language-Model Benchmarks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T22:20:24.650356Z"},"links":{"cited_paper":"/paper/2309.06180","citing_paper":"/paper/2508.07179"},"observation_digest":"sha256:a3373b8d48002258a18ff62c5ef97b55ba7681f6fb57b1edf5a5f945c459da61","observation_id":"aabd482a-7823-4001-814e-4426d5f785e3","resolution":{"observed_at":"2026-08-05T22:20:24.650356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:20:25.432108Z","title":"sqlparse: a non-validating sql parser for python","venue":null,"work_id":"e579a183-b262-4455-93b9-19a42da6cded","year":2025},"citing_paper":{"arxiv_id":"2508.07179","last_updated":"2025-08-10T05:04:32Z","snapshot_observed_at":"2026-08-16T17:21:52.192023Z","submitted_at":"2025-08-10T05:04:32Z","title":"Schema Lineage Extraction at Scale: Multilingual Pipelines, Composite Evaluation, and Language-Model Benchmarks","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T22:20:24.655093Z"},"links":{"citing_paper":"/paper/2508.07179"},"observation_digest":"sha256:0bff8c72e76f6e7fa87086902c1e76414868b9f8b20ecb1d7307bc8d6f68c25a","observation_id":"fab87526-8823-49a4-aa78-da9ed39d9605","resolution":{"observed_at":"2026-08-05T22:20:25.547765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:20:25.417798Z","title":"Open source project (sqlfluff.com, GitHub), 2025","venue":null,"work_id":"34932e43-b581-4534-bf75-fc724b14bdeb","year":2025},"citing_paper":{"arxiv_id":"2508.07179","last_updated":"2025-08-10T05:04:32Z","snapshot_observed_at":"2026-08-16T17:21:52.192023Z","submitted_at":"2025-08-10T05:04:32Z","title":"Schema Lineage Extraction at Scale: Multilingual Pipelines, Composite Evaluation, and Language-Model Benchmarks","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T22:20:24.659291Z"},"links":{"citing_paper":"/paper/2508.07179"},"observation_digest":"sha256:9549c9157762b08b6f42ec9cda468a8e2b4c997d15240754984d31cd35ba9f76","observation_id":"58247e0e-cedf-4f63-ad0a-6987a846f1db","resolution":{"observed_at":"2026-08-05T22:20:25.422379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:20:25.404247Z","title":"Data lineage in classic data catalog","venue":null,"work_id":"a2c57f25-e0af-43c1-9d58-23851d456f24","year":2025},"citing_paper":{"arxiv_id":"2508.07179","last_updated":"2025-08-10T05:04:32Z","snapshot_observed_at":"2026-08-16T17:21:52.192023Z","submitted_at":"2025-08-10T05:04:32Z","title":"Schema Lineage Extraction at Scale: Multilingual Pipelines, Composite Evaluation, and Language-Model Benchmarks","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T22:20:24.663980Z"},"links":{"citing_paper":"/paper/2508.07179"},"observation_digest":"sha256:91c5a86c58d5e35d23a280600e088a9e7e1f3341596eb2e5d4b6321bfa8609de","observation_id":"2f3a53f1-c26e-4ebc-b647-d9600346569e","resolution":{"observed_at":"2026-08-05T22:20:25.408612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:20:25.390272Z","title":"Online; accessed 2025-07-30","venue":null,"work_id":"affd233b-7e6c-4e2b-8b74-1ba4e9268228","year":2025},"citing_paper":{"arxiv_id":"2508.07179","last_updated":"2025-08-10T05:04:32Z","snapshot_observed_at":"2026-08-16T17:21:52.192023Z","submitted_at":"2025-08-10T05:04:32Z","title":"Schema Lineage Extraction at Scale: Multilingual Pipelines, Composite Evaluation, and Language-Model Benchmarks","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T22:20:24.668974Z"},"links":{"citing_paper":"/paper/2508.07179"},"observation_digest":"sha256:4e28fdc4314e05fb18acec0f15a7a1781f33afa7c5242f33047b095289448536","observation_id":"0ae2749e-18a8-4c4f-8fef-e2878073d677","resolution":{"observed_at":"2026-08-05T22:20:25.394662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:20:25.376919Z","title":"A large language model-based approach for data lineage parsing","venue":null,"work_id":"97ce39ba-fb76-4e0f-817c-4bf97e8acf1c","year":2025},"citing_paper":{"arxiv_id":"2508.07179","last_updated":"2025-08-10T05:04:32Z","snapshot_observed_at":"2026-08-16T17:21:52.192023Z","submitted_at":"2025-08-10T05:04:32Z","title":"Schema Lineage Extraction at Scale: Multilingual Pipelines, Composite Evaluation, and Language-Model Benchmarks","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T22:20:24.673462Z"},"links":{"citing_paper":"/paper/2508.07179"},"observation_digest":"sha256:f3a91f42656b51a7a01dee471d975d9ec4e03860d2116a600d1408b4d672a43d","observation_id":"f871fcad-366c-4989-9a00-56330455b5d5","resolution":{"observed_at":"2026-08-05T22:20:25.381499Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:20:25.362277Z","title":"Introducing the Large Lineage Model (LLiM): Our Path to Securing the FutureofData","venue":null,"work_id":"e724fe59-b175-406b-9050-6ff932469fed","year":2025},"citing_paper":{"arxiv_id":"2508.07179","last_updated":"2025-08-10T05:04:32Z","snapshot_observed_at":"2026-08-16T17:21:52.192023Z","submitted_at":"2025-08-10T05:04:32Z","title":"Schema Lineage Extraction at Scale: Multilingual Pipelines, Composite Evaluation, and Language-Model Benchmarks","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T22:20:24.678034Z"},"links":{"citing_paper":"/paper/2508.07179"},"observation_digest":"sha256:58541c4422054810f1aea8a74df6eb5308395a4962076d16590f83bebe6407db","observation_id":"9d351a50-4643-4cbd-a587-af1e877e4ea7","resolution":{"observed_at":"2026-08-05T22:20:25.367757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:20:25.346805Z","title":"Tpc-h benchmark – apache doris documentation.https://doris","venue":null,"work_id":"ec50a991-2efd-49d4-a39b-6bdda5531e03","year":2025},"citing_paper":{"arxiv_id":"2508.07179","last_updated":"2025-08-10T05:04:32Z","snapshot_observed_at":"2026-08-16T17:21:52.192023Z","submitted_at":"2025-08-10T05:04:32Z","title":"Schema Lineage Extraction at Scale: Multilingual Pipelines, Composite Evaluation, and Language-Model Benchmarks","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T22:20:24.682985Z"},"links":{"citing_paper":"/paper/2508.07179"},"observation_digest":"sha256:19441a92be8a1d23bcebc8c5789322a6eea54679328bb9a33da2056bfcd94571","observation_id":"7fcad381-9942-421a-ae37-bb0b4f8a10da","resolution":{"observed_at":"2026-08-05T22:20:25.352266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:20:25.332124Z","title":"An open dataset of data lineage graphs for data governance research.Visual Informatics, 8(1):1–5,","venue":null,"work_id":"602201d6-3c83-4831-98b1-899e4a65cee6","year":null},"citing_paper":{"arxiv_id":"2508.07179","last_updated":"2025-08-10T05:04:32Z","snapshot_observed_at":"2026-08-16T17:21:52.192023Z","submitted_at":"2025-08-10T05:04:32Z","title":"Schema Lineage Extraction at Scale: Multilingual Pipelines, Composite Evaluation, and Language-Model Benchmarks","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T22:20:24.687980Z"},"links":{"citing_paper":"/paper/2508.07179"},"observation_digest":"sha256:7eb68dfa691e4e5d9d5cc32248650c1701d2a60fededcab88a05fea37cd5b24e","observation_id":"ffc192da-670b-4ec2-9b1b-da68a6980cfa","resolution":{"observed_at":"2026-08-05T22:20:25.337200Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:20:25.303005Z","title":"LlamaIndex, 11 2022","venue":null,"work_id":"0e7304f0-fbca-46d6-95f5-8ac3db48b5e9","year":2022},"citing_paper":{"arxiv_id":"2508.07179","last_updated":"2025-08-10T05:04:32Z","snapshot_observed_at":"2026-08-16T17:21:52.192023Z","submitted_at":"2025-08-10T05:04:32Z","title":"Schema Lineage Extraction at Scale: Multilingual Pipelines, Composite Evaluation, and Language-Model Benchmarks","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T22:20:24.696871Z"},"links":{"citing_paper":"/paper/2508.07179"},"observation_digest":"sha256:55e5cb6dad77659c91f61b6293bff3ec47e01e669eaaa32eda7ba535a34ab7d0","observation_id":"0a7f6347-11a9-4dfb-960f-cd4ff9026d1a","resolution":{"observed_at":"2026-08-05T22:20:25.307543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.08887","last_updated":"2019-02-02T23:53:18Z","snapshot_observed_at":"2026-08-14T18:24:27.863819Z","submitted_at":"2018-09-24T13:03:13Z","title":"Spider: A Large-Scale Human-Labeled Dataset for Complex and Cross-Domain Semantic Parsing and Text-to-SQL Task","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.08887","snapshot_observed_at":"2026-08-05T22:20:24.700973Z","title":"Spider: A large-scalehuman-labeleddatasetforcomplexandcross-domainsemanticparsingandtext-to-sql task, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.07179","last_updated":"2025-08-10T05:04:32Z","snapshot_observed_at":"2026-08-16T17:21:52.192023Z","submitted_at":"2025-08-10T05:04:32Z","title":"Schema Lineage Extraction at Scale: Multilingual Pipelines, Composite Evaluation, and Language-Model Benchmarks","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T22:20:24.700973Z"},"links":{"cited_paper":"/paper/1809.08887","citing_paper":"/paper/2508.07179"},"observation_digest":"sha256:3b38fa274527574572ec0b048569e6af9e85ae82388499d6cb9ade2d8c81bd76","observation_id":"80527fe2-b729-4503-9d19-264b58fdb203","resolution":{"observed_at":"2026-08-05T22:20:24.700973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:20:25.288916Z","title":"Gpt-4.1, 2025","venue":null,"work_id":"91341fdd-1bbf-42b7-99cc-7a788ea736f1","year":2025},"citing_paper":{"arxiv_id":"2508.07179","last_updated":"2025-08-10T05:04:32Z","snapshot_observed_at":"2026-08-16T17:21:52.192023Z","submitted_at":"2025-08-10T05:04:32Z","title":"Schema Lineage Extraction at Scale: Multilingual Pipelines, Composite Evaluation, and Language-Model Benchmarks","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T22:20:24.705436Z"},"links":{"citing_paper":"/paper/2508.07179"},"observation_digest":"sha256:e2d5d1579393594b1bcb05441cbd33f217b9d18eb56b19e50f511a2084b1def2","observation_id":"94f5839d-35d3-4050-8561-24b8adc799d8","resolution":{"observed_at":"2026-08-05T22:20:25.293318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:20:25.272964Z","title":"Hello gpt-4o, May 2024","venue":null,"work_id":"a1cb4b82-48fc-4920-91d2-f29588431df7","year":2024},"citing_paper":{"arxiv_id":"2508.07179","last_updated":"2025-08-10T05:04:32Z","snapshot_observed_at":"2026-08-16T17:21:52.192023Z","submitted_at":"2025-08-10T05:04:32Z","title":"Schema Lineage Extraction at Scale: Multilingual Pipelines, Composite Evaluation, and Language-Model Benchmarks","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T22:20:24.710021Z"},"links":{"citing_paper":"/paper/2508.07179"},"observation_digest":"sha256:93ff21790abdb3b984601fc87c46b84bec1b948f65fe508096bc40079aa60c83","observation_id":"ca82c75e-70ce-46fc-80b9-18125bae6c34","resolution":{"observed_at":"2026-08-05T22:20:25.278380Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12186","last_updated":"2024-11-12T13:24:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-18T17:57:57Z","title":"Qwen2.5-Coder Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12186","snapshot_observed_at":"2026-08-05T22:20:24.714536Z","title":"Qwen2.5-coder technical report, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07179","last_updated":"2025-08-10T05:04:32Z","snapshot_observed_at":"2026-08-16T17:21:52.192023Z","submitted_at":"2025-08-10T05:04:32Z","title":"Schema Lineage Extraction at Scale: Multilingual Pipelines, Composite Evaluation, and Language-Model Benchmarks","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T22:20:24.714536Z"},"links":{"cited_paper":"/paper/2409.12186","citing_paper":"/paper/2508.07179"},"observation_digest":"sha256:dadfadd3f953dc8e4ceb2411d4a26bada9b0e28cab6376886ec688d8454fdc6a","observation_id":"0ab3a2ce-1e47-4718-b782-32fdd4fc9418","resolution":{"observed_at":"2026-08-05T22:20:24.714536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-05T22:20:24.719939Z","title":"Jiang, Alexandre Sablayrolles, Arthur Mensch, Chris Bamford, Devendra Singh Chaplot, Diego de las Casas, Florian Bressand, et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.07179","last_updated":"2025-08-10T05:04:32Z","snapshot_observed_at":"2026-08-16T17:21:52.192023Z","submitted_at":"2025-08-10T05:04:32Z","title":"Schema Lineage Extraction at Scale: Multilingual Pipelines, Composite Evaluation, and Language-Model Benchmarks","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T22:20:24.719939Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2508.07179"},"observation_digest":"sha256:d06120ea65f10733f85b11792d0c4b0c62d4efecc1a017bcbd1562e37aac28ab","observation_id":"90c5a934-2c75-47db-83aa-c14f5d0cf250","resolution":{"observed_at":"2026-08-05T22:20:24.719939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:20:25.259428Z","title":"Codestral, 2024","venue":null,"work_id":"d4e4a85f-664c-4d05-9dc8-f904567754ff","year":2024},"citing_paper":{"arxiv_id":"2508.07179","last_updated":"2025-08-10T05:04:32Z","snapshot_observed_at":"2026-08-16T17:21:52.192023Z","submitted_at":"2025-08-10T05:04:32Z","title":"Schema Lineage Extraction at Scale: Multilingual Pipelines, Composite Evaluation, and Language-Model Benchmarks","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T22:20:24.724133Z"},"links":{"citing_paper":"/paper/2508.07179"},"observation_digest":"sha256:88c559fc46138ae34ccf3c912103b6abda512ca999c84c1f948f9e012e35c23f","observation_id":"ab1396df-2df9-49d5-bdb2-3187dc4c69bd","resolution":{"observed_at":"2026-08-05T22:20:25.263807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12950","last_updated":"2024-01-31T19:47:26Z","snapshot_observed_at":"2026-08-13T04:25:38.282910Z","submitted_at":"2023-08-24T17:39:13Z","title":"Code Llama: Open Foundation Models for Code","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12950","snapshot_observed_at":"2026-08-05T22:20:24.728232Z","title":"Code llama: Open foundation models for code, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07179","last_updated":"2025-08-10T05:04:32Z","snapshot_observed_at":"2026-08-16T17:21:52.192023Z","submitted_at":"2025-08-10T05:04:32Z","title":"Schema Lineage Extraction at Scale: Multilingual Pipelines, Composite Evaluation, and Language-Model Benchmarks","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T22:20:24.728232Z"},"links":{"cited_paper":"/paper/2308.12950","citing_paper":"/paper/2508.07179"},"observation_digest":"sha256:03164389ff47643fbfba3987178e14686b8253f3574cce6e28290f69c86160af","observation_id":"5d588f1a-5cb5-4995-82d4-b0f13b345a87","resolution":{"observed_at":"2026-08-05T22:20:24.728232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11931","last_updated":"2024-06-17T13:51:35Z","snapshot_observed_at":"2026-08-14T04:42:19.578053Z","submitted_at":"2024-06-17T13:51:35Z","title":"DeepSeek-Coder-V2: Breaking the Barrier of Closed-Source Models in Code Intelligence","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11931","snapshot_observed_at":"2026-08-05T22:20:24.732549Z","title":"Deepseek- coder-v2: Breaking the barrier of closed-source models in code intelligence, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07179","last_updated":"2025-08-10T05:04:32Z","snapshot_observed_at":"2026-08-16T17:21:52.192023Z","submitted_at":"2025-08-10T05:04:32Z","title":"Schema Lineage Extraction at Scale: Multilingual Pipelines, Composite Evaluation, and Language-Model Benchmarks","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T22:20:24.732549Z"},"links":{"cited_paper":"/paper/2406.11931","citing_paper":"/paper/2508.07179"},"observation_digest":"sha256:91c0a6308369fc2079dbd9e9453f8e52abffc91a1820b06e51c2f2326091eda5","observation_id":"08d5194c-d803-456f-a55b-5844705e46ee","resolution":{"observed_at":"2026-08-05T22:20:24.732549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.21233","last_updated":"2025-04-30T00:04:35Z","snapshot_observed_at":"2026-08-16T05:07:13.831945Z","submitted_at":"2025-04-30T00:04:35Z","title":"Phi-4-Mini-Reasoning: Exploring the Limits of Small Reasoning Language Models in Math","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.21233","snapshot_observed_at":"2026-08-05T22:20:24.737694Z","title":"Phi-4-mini-reasoning: Exploring the limits of small reasoning language models in math, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.07179","last_updated":"2025-08-10T05:04:32Z","snapshot_observed_at":"2026-08-16T17:21:52.192023Z","submitted_at":"2025-08-10T05:04:32Z","title":"Schema Lineage Extraction at Scale: Multilingual Pipelines, Composite Evaluation, and Language-Model Benchmarks","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T22:20:24.737694Z"},"links":{"cited_paper":"/paper/2504.21233","citing_paper":"/paper/2508.07179"},"observation_digest":"sha256:d14848bfc325b53717bf30351c795ae3a43a59778a570f1cfc60e42dd36c27c0","observation_id":"a9510132-f868-48a7-9668-048f260c9ea5","resolution":{"observed_at":"2026-08-05T22:20:24.737694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:20:25.244304Z","title":"Phi-4 technical report, 2024","venue":null,"work_id":"85d9e597-6089-4125-8b17-fe54f13f60e9","year":2024},"citing_paper":{"arxiv_id":"2508.07179","last_updated":"2025-08-10T05:04:32Z","snapshot_observed_at":"2026-08-16T17:21:52.192023Z","submitted_at":"2025-08-10T05:04:32Z","title":"Schema Lineage Extraction at Scale: Multilingual Pipelines, Composite Evaluation, and Language-Model Benchmarks","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T22:20:24.742167Z"},"links":{"citing_paper":"/paper/2508.07179"},"observation_digest":"sha256:6ad11bdc4b897b64ba7eb21c6f2cc233bd5f7342478e40db3d0bf2cd2c8a0e60","observation_id":"b2c87623-cf45-47cf-a23f-80a6a0e9765d","resolution":{"observed_at":"2026-08-05T22:20:25.249257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.21318","last_updated":"2025-04-30T05:05:09Z","snapshot_observed_at":"2026-08-12T04:56:27.232647Z","submitted_at":"2025-04-30T05:05:09Z","title":"Phi-4-reasoning Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.21318","snapshot_observed_at":"2026-08-05T22:20:24.747796Z","title":"Phi-4-reasoningtechnicalreport, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.07179","last_updated":"2025-08-10T05:04:32Z","snapshot_observed_at":"2026-08-16T17:21:52.192023Z","submitted_at":"2025-08-10T05:04:32Z","title":"Schema Lineage Extraction at Scale: Multilingual Pipelines, Composite Evaluation, and Language-Model Benchmarks","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T22:20:24.747796Z"},"links":{"cited_paper":"/paper/2504.21318","citing_paper":"/paper/2508.07179"},"observation_digest":"sha256:00e438edb1b6dbc3682e11947a0e69aedd0d5117b9b8b1d08239ec5647875330","observation_id":"aa83e356-6452-475c-b001-a6316e38fe06","resolution":{"observed_at":"2026-08-05T22:20:24.747796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.00515","last_updated":"2024-11-10T22:02:27Z","snapshot_observed_at":"2026-08-14T16:40:35.729198Z","submitted_at":"2024-06-01T17:48:15Z","title":"A Survey on Large Language Models for Code Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.00515","snapshot_observed_at":"2026-08-05T22:20:24.752252Z","title":"Asurveyonlargelanguage models for code generation, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07179","last_updated":"2025-08-10T05:04:32Z","snapshot_observed_at":"2026-08-16T17:21:52.192023Z","submitted_at":"2025-08-10T05:04:32Z","title":"Schema Lineage Extraction at Scale: Multilingual Pipelines, Composite Evaluation, and Language-Model Benchmarks","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T22:20:24.752252Z"},"links":{"cited_paper":"/paper/2406.00515","citing_paper":"/paper/2508.07179"},"observation_digest":"sha256:c791d6cae931c8923ea3e6c78d9e4b42c4417acfb9975d12b90d6cb0269cd6f9","observation_id":"0deffd62-e450-4e77-9c02-708646e74bba","resolution":{"observed_at":"2026-08-05T22:20:24.752252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-08-13T07:04:41.220509Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.11903","snapshot_observed_at":"2026-08-05T22:20:24.756811Z","title":"Chain-of-thought prompting elicits reasoning in large language models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.07179","last_updated":"2025-08-10T05:04:32Z","snapshot_observed_at":"2026-08-16T17:21:52.192023Z","submitted_at":"2025-08-10T05:04:32Z","title":"Schema Lineage Extraction at Scale: Multilingual Pipelines, Composite Evaluation, and Language-Model Benchmarks","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T22:20:24.756811Z"},"links":{"cited_paper":"/paper/2201.11903","citing_paper":"/paper/2508.07179"},"observation_digest":"sha256:7167bcc3256771583f82e9ab9f46cabb91a6cb3e74660f46649592c16228c5da","observation_id":"070709aa-4db2-4c8b-b88f-9de1ce400a1b","resolution":{"observed_at":"2026-08-05T22:20:24.756811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:20:24.762392Z","title":"email_address","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07179","last_updated":"2025-08-10T05:04:32Z","snapshot_observed_at":"2026-08-16T17:21:52.192023Z","submitted_at":"2025-08-10T05:04:32Z","title":"Schema Lineage Extraction at Scale: Multilingual Pipelines, Composite Evaluation, and Language-Model Benchmarks","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T22:20:24.762392Z"},"links":{"citing_paper":"/paper/2508.07179"},"observation_digest":"sha256:93c150a14d0183324623fadf91dd357586e5bf8ad7b04e484b180036fae38400","observation_id":"fecab091-24e2-4262-857f-ee3c25a63a98","resolution":{"observed_at":"2026-08-05T22:20:24.762392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:20:25.229956Z","title":"</think>","venue":null,"work_id":"48c76f6f-6f62-4e8b-93ec-3678906e1200","year":null},"citing_paper":{"arxiv_id":"2508.07179","last_updated":"2025-08-10T05:04:32Z","snapshot_observed_at":"2026-08-16T17:21:52.192023Z","submitted_at":"2025-08-10T05:04:32Z","title":"Schema Lineage Extraction at Scale: Multilingual Pipelines, Composite Evaluation, and Language-Model Benchmarks","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T22:20:24.767578Z"},"links":{"citing_paper":"/paper/2508.07179"},"observation_digest":"sha256:e0b86eaec5d683b3a3f720b472a7ece2be844161c2b7077a34dec267e3706705","observation_id":"f45420b1-df88-4701-b954-76b649fb0a7d","resolution":{"observed_at":"2026-08-05T22:20:25.234584Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:20:25.215528Z","title":"source_schema","venue":null,"work_id":"9bfa99bb-1883-4d23-b1da-ef68a65b3a65","year":null},"citing_paper":{"arxiv_id":"2508.07179","last_updated":"2025-08-10T05:04:32Z","snapshot_observed_at":"2026-08-16T17:21:52.192023Z","submitted_at":"2025-08-10T05:04:32Z","title":"Schema Lineage Extraction at Scale: Multilingual Pipelines, Composite Evaluation, and Language-Model Benchmarks","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T22:20:24.771947Z"},"links":{"citing_paper":"/paper/2508.07179"},"observation_digest":"sha256:54b0a73d93c9868cd094b53a98d7abad840fa6c650625fb8196426dc0f313c02","observation_id":"5ed25296-044f-4228-9874-53792b7feb1a","resolution":{"observed_at":"2026-08-05T22:20:25.220317Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:20:25.317379Z","title":null,"venue":null,"work_id":"4caa0bc1-07c6-45d1-ab8f-9f0781af865d","year":null},"citing_paper":{"arxiv_id":"2508.07179","last_updated":"2025-08-10T05:04:32Z","snapshot_observed_at":"2026-08-16T17:21:52.192023Z","submitted_at":"2025-08-10T05:04:32Z","title":"Schema Lineage Extraction at Scale: Multilingual Pipelines, Composite Evaluation, and Language-Model Benchmarks","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-05T22:20:24.692401Z"},"links":{"citing_paper":"/paper/2508.07179"},"observation_digest":"sha256:3293ca983d682c746ab8f6efed5a16010d6ea89a997846b54d90fa7f5ca76150","observation_id":"d30f5585-951a-4d67-81f7-453eb7e0aa2f","resolution":{"observed_at":"2026-08-05T22:20:25.322026Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.07179","last_updated":"2025-08-10T05:04:32Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-16T17:21:52.192023Z","submitted_at":"2025-08-10T05:04:32Z","title":"Schema Lineage Extraction at Scale: Multilingual Pipelines, Composite Evaluation, and Language-Model Benchmarks"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":22,"verified_exact":2,"verified_fuzzy":13},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 0 inbound Pith citation observations for arXiv:2508.07179."}