{"as_of":"2026-08-14T17:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0e97ace4954ddb66d99cd423fc71b75ac6c8c1fafcea0ba6330e206b1f03d07a","coverage":[{"denominator":17,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T04:34:15.067301Z","state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.06065/citation-record","integrity":"/paper/2509.06065/integrity","json":"/paper/2509.06065/citation-record.json","paper":"/paper/2509.06065"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:34:18.729957Z","title":"https: //www.nature.com/articles/s41598-025-98483-1","venue":null,"work_id":"25ff68b8-96e8-45fe-bd1a-366a6cf18db0","year":2025},"citing_paper":{"arxiv_id":"2509.06065","last_updated":"2025-09-07T14:09:57Z","snapshot_observed_at":"2026-08-13T14:53:06.943743Z","submitted_at":"2025-09-07T14:09:57Z","title":"KatotohananQA: Evaluating Truthfulness of Large Language Models in Filipino","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T04:34:12.775402Z"},"links":{"citing_paper":"/paper/2509.06065"},"observation_digest":"sha256:8198a95914cb2384c5f4c436fa16ae1c1f91356d082a6ec94ea39d126841ae91","observation_id":"8e020b3f-7e2e-47a8-952e-23460ec651e1","resolution":{"observed_at":"2026-08-05T04:34:18.841396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:34:18.482665Z","title":"https: //www.nature.com/articles/s41586-024-07421-0","venue":null,"work_id":"b886c038-f702-47e0-b754-d10b86fa9ef0","year":2024},"citing_paper":{"arxiv_id":"2509.06065","last_updated":"2025-09-07T14:09:57Z","snapshot_observed_at":"2026-08-13T14:53:06.943743Z","submitted_at":"2025-09-07T14:09:57Z","title":"KatotohananQA: Evaluating Truthfulness of Large Language Models in Filipino","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T04:34:12.854025Z"},"links":{"citing_paper":"/paper/2509.06065"},"observation_digest":"sha256:3536b67cd6c06f24f6c44a8eff554f7663657a7b5193080a9a0e84c2d44af0db","observation_id":"8f534799-7d9b-46a3-95d5-bef04b4c8bb4","resolution":{"observed_at":"2026-08-05T04:34:18.588446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.05232","last_updated":"2024-11-19T12:42:45Z","snapshot_observed_at":"2026-07-06T16:45:07.733095Z","submitted_at":"2023-11-09T09:25:37Z","title":"A Survey on Hallucination in Large Language Models: Principles, Taxonomy, Challenges, and Open Questions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.05232","snapshot_observed_at":"2026-08-05T04:34:13.022585Z","title":"https://arxiv.org/abs/2311.05232","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.06065","last_updated":"2025-09-07T14:09:57Z","snapshot_observed_at":"2026-08-13T14:53:06.943743Z","submitted_at":"2025-09-07T14:09:57Z","title":"KatotohananQA: Evaluating Truthfulness of Large Language Models in Filipino","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T04:34:13.022585Z"},"links":{"cited_paper":"/paper/2311.05232","citing_paper":"/paper/2509.06065"},"observation_digest":"sha256:70492fe4e90db97c8c387e3fb14a799089f2f98f80543a31be5f4e18cb493f1f","observation_id":"dafac304-5e89-4c1a-9351-af85aa11d3d9","resolution":{"observed_at":"2026-08-05T04:34:13.022585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.07958","last_updated":"2022-05-08T02:43:02Z","snapshot_observed_at":"2026-08-03T16:26:48.747700Z","submitted_at":"2021-09-08T17:15:27Z","title":"TruthfulQA: Measuring How Models Mimic Human Falsehoods","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.07958","snapshot_observed_at":"2026-08-05T04:34:13.134166Z","title":"https://arxiv.org/abs/2109","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.06065","last_updated":"2025-09-07T14:09:57Z","snapshot_observed_at":"2026-08-13T14:53:06.943743Z","submitted_at":"2025-09-07T14:09:57Z","title":"KatotohananQA: Evaluating Truthfulness of Large Language Models in Filipino","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T04:34:13.134166Z"},"links":{"cited_paper":"/paper/2109.07958","citing_paper":"/paper/2509.06065"},"observation_digest":"sha256:843a0bc4bf05d85dfd0362060c74379d976d149e71a336e1077249de93a6accd","observation_id":"cf25dc17-5198-4b90-b25b-829dbeb7f572","resolution":{"observed_at":"2026-08-05T04:34:13.134166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:34:18.180577Z","title":"LessWrong(2025)","venue":null,"work_id":"e977125e-c297-43b9-85ce-ae9799a74714","year":2025},"citing_paper":{"arxiv_id":"2509.06065","last_updated":"2025-09-07T14:09:57Z","snapshot_observed_at":"2026-08-13T14:53:06.943743Z","submitted_at":"2025-09-07T14:09:57Z","title":"KatotohananQA: Evaluating Truthfulness of Large Language Models in Filipino","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T04:34:13.256045Z"},"links":{"citing_paper":"/paper/2509.06065"},"observation_digest":"sha256:812239e403d7f6c89d170b63a7c81514762522d9c077013551c232ce9c70c689","observation_id":"5c3f8478-e4fd-4e1d-94ef-9fed3d631d1e","resolution":{"observed_at":"2026-08-05T04:34:18.362908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:34:17.938707Z","title":"Association for Computational Lin- guistics","venue":null,"work_id":"4dac3564-2578-477e-9472-4f1812061191","year":2024},"citing_paper":{"arxiv_id":"2509.06065","last_updated":"2025-09-07T14:09:57Z","snapshot_observed_at":"2026-08-13T14:53:06.943743Z","submitted_at":"2025-09-07T14:09:57Z","title":"KatotohananQA: Evaluating Truthfulness of Large Language Models in Filipino","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T04:34:13.420371Z"},"links":{"citing_paper":"/paper/2509.06065"},"observation_digest":"sha256:df6f393d3a89ec608d3a5c15347272f4b3823982cc6641cda90445ded273d271","observation_id":"2147dc05-b97f-4c0e-81dd-e56cbe30ccca","resolution":{"observed_at":"2026-08-05T04:34:18.046645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:34:17.699913Z","title":"https://commoncrawl.github.io/ cc-crawl-statistics/plots/languages","venue":null,"work_id":"004706be-ec88-45a0-8769-48393380af64","year":2025},"citing_paper":{"arxiv_id":"2509.06065","last_updated":"2025-09-07T14:09:57Z","snapshot_observed_at":"2026-08-13T14:53:06.943743Z","submitted_at":"2025-09-07T14:09:57Z","title":"KatotohananQA: Evaluating Truthfulness of Large Language Models in Filipino","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T04:34:13.590672Z"},"links":{"citing_paper":"/paper/2509.06065"},"observation_digest":"sha256:61b68e66e320e7d70d05d3f89567573274ec4ff40912540efbeb2fd984983dad","observation_id":"825e1b1d-0ad7-46b3-beb4-8e42c1f0fc07","resolution":{"observed_at":"2026-08-05T04:34:17.807059Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16787","last_updated":"2023-11-04T19:10:06Z","snapshot_observed_at":"2026-08-13T05:40:31.355462Z","submitted_at":"2023-10-25T17:20:26Z","title":"The Data Provenance Initiative: A Large Scale Audit of Dataset Licensing & Attribution in AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16787","snapshot_observed_at":"2026-08-05T04:34:13.772914Z","title":"https://arxiv.org/abs/2310.16787","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.06065","last_updated":"2025-09-07T14:09:57Z","snapshot_observed_at":"2026-08-13T14:53:06.943743Z","submitted_at":"2025-09-07T14:09:57Z","title":"KatotohananQA: Evaluating Truthfulness of Large Language Models in Filipino","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T04:34:13.772914Z"},"links":{"cited_paper":"/paper/2310.16787","citing_paper":"/paper/2509.06065"},"observation_digest":"sha256:5db2dceb96c6117ee7b67f93a80a459d7d8122543fc7aa629e066d4684162fe9","observation_id":"24652b06-c21f-4849-90b4-1714d52eaafb","resolution":{"observed_at":"2026-08-05T04:34:13.772914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14911","last_updated":"2025-06-19T08:30:50Z","snapshot_observed_at":"2026-08-14T09:36:41.230462Z","submitted_at":"2025-02-19T07:03:15Z","title":"Batayan: A Filipino NLP benchmark for evaluating Large Language Models","version":2},"cited_work":{"arxiv_id":"2502.14911","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.14911","snapshot_observed_at":"2026-08-05T04:34:16.427217Z","title":"Batayan: A Filipino NLP benchmark for evaluating Large Language Models","venue":"cs.CL","work_id":"8570a43d-4c7b-4181-820b-a0e09ddf88e6","year":2025},"citing_paper":{"arxiv_id":"2509.06065","last_updated":"2025-09-07T14:09:57Z","snapshot_observed_at":"2026-08-13T14:53:06.943743Z","submitted_at":"2025-09-07T14:09:57Z","title":"KatotohananQA: Evaluating Truthfulness of Large Language Models in Filipino","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T04:34:13.877584Z"},"links":{"cited_paper":"/paper/2502.14911","citing_paper":"/paper/2509.06065"},"observation_digest":"sha256:543e1204e143a3060b59240d0d71f982691092979be2f80ea5d1afd175d7827d","observation_id":"2bf1059f-d29b-4368-a078-23d820ce234d","resolution":{"observed_at":"2026-08-05T04:34:16.604534Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2502.09387","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:34:16.080097Z","title":"arXiv preprint arXiv:2502.09387(2025)","venue":null,"work_id":"8be5614c-d7f5-430c-8a75-77e0ae4d9dc5","year":2025},"citing_paper":{"arxiv_id":"2509.06065","last_updated":"2025-09-07T14:09:57Z","snapshot_observed_at":"2026-08-13T14:53:06.943743Z","submitted_at":"2025-09-07T14:09:57Z","title":"KatotohananQA: Evaluating Truthfulness of Large Language Models in Filipino","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T04:34:14.027859Z"},"links":{"citing_paper":"/paper/2509.06065"},"observation_digest":"sha256:4c5b0113ae5f31f6d3bd4a1de0455d7a5a00f3df1e8b3ea75cb7d70f4330e38c","observation_id":"f1faeaab-6ade-41b5-a9b0-b8dea4f463da","resolution":{"observed_at":"2026-08-05T04:34:16.261035Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:34:17.443367Z","title":"Association for Computational Linguistics","venue":null,"work_id":"37afce7c-ea6f-48f3-8ab5-fe0ce672f76b","year":2025},"citing_paper":{"arxiv_id":"2509.06065","last_updated":"2025-09-07T14:09:57Z","snapshot_observed_at":"2026-08-13T14:53:06.943743Z","submitted_at":"2025-09-07T14:09:57Z","title":"KatotohananQA: Evaluating Truthfulness of Large Language Models in Filipino","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T04:34:14.139147Z"},"links":{"citing_paper":"/paper/2509.06065"},"observation_digest":"sha256:43c0b93a0e51698aa73b1ea36bd4958657d3397388b7eac2845eaced2cebb669","observation_id":"9fcf1110-bd84-44fe-b5c5-32254e182b10","resolution":{"observed_at":"2026-08-05T04:34:17.537765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00948","last_updated":"2024-12-01T19:46:40Z","snapshot_observed_at":"2026-08-14T05:03:03.551948Z","submitted_at":"2024-12-01T19:46:40Z","title":"Uhura: A Benchmark for Evaluating Scientific Question Answering and Truthfulness in Low-Resource African Languages","version":1},"cited_work":{"arxiv_id":"2412.00948","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.00948","snapshot_observed_at":"2026-08-05T04:34:15.539178Z","title":"Uhura: A Benchmark for Evaluating Scientific Question Answering and Truthfulness in Low-Resource African Languages","venue":"cs.CL","work_id":"1ce92246-0dbe-4465-b39b-1919000ebb06","year":2024},"citing_paper":{"arxiv_id":"2509.06065","last_updated":"2025-09-07T14:09:57Z","snapshot_observed_at":"2026-08-13T14:53:06.943743Z","submitted_at":"2025-09-07T14:09:57Z","title":"KatotohananQA: Evaluating Truthfulness of Large Language Models in Filipino","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T04:34:14.256912Z"},"links":{"cited_paper":"/paper/2412.00948","citing_paper":"/paper/2509.06065"},"observation_digest":"sha256:5e5e2226e7bf6e86712c59f75495fe5db0c156862f266ff7ee834b4c81349f59","observation_id":"a749506c-f4c3-4ce3-9133-c92e07c54505","resolution":{"observed_at":"2026-08-05T04:34:15.667230Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.05794","last_updated":"2022-03-11T08:35:15Z","snapshot_observed_at":"2026-07-06T12:46:41.057346Z","submitted_at":"2022-03-11T08:35:15Z","title":"BERTopic: Neural topic modeling with a class-based TF-IDF procedure","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.05794","snapshot_observed_at":"2026-08-05T04:34:14.429081Z","title":"https://arxiv.org/abs/2203","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.06065","last_updated":"2025-09-07T14:09:57Z","snapshot_observed_at":"2026-08-13T14:53:06.943743Z","submitted_at":"2025-09-07T14:09:57Z","title":"KatotohananQA: Evaluating Truthfulness of Large Language Models in Filipino","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T04:34:14.429081Z"},"links":{"cited_paper":"/paper/2203.05794","citing_paper":"/paper/2509.06065"},"observation_digest":"sha256:cb2b3601b6922ec97bd62666f46a07d55ef6a477cff3fbe0215c89aa240a74dd","observation_id":"084fcc2b-b44b-4dbe-8a23-7e57192efd35","resolution":{"observed_at":"2026-08-05T04:34:14.429081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:34:17.119350Z","title":"S.: Chapter 5: Tests for Paired Nominal Data.R Companion Hand- book(2025)","venue":null,"work_id":"de68112a-464c-450d-8dc5-8d8c37589331","year":2025},"citing_paper":{"arxiv_id":"2509.06065","last_updated":"2025-09-07T14:09:57Z","snapshot_observed_at":"2026-08-13T14:53:06.943743Z","submitted_at":"2025-09-07T14:09:57Z","title":"KatotohananQA: Evaluating Truthfulness of Large Language Models in Filipino","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T04:34:14.590487Z"},"links":{"citing_paper":"/paper/2509.06065"},"observation_digest":"sha256:51e14c46302cad2fab8a826a11b11844a0ae932491c4250d75315915f88a9826","observation_id":"d49f8eb6-9f6f-4365-bc30-3c8d113fcae8","resolution":{"observed_at":"2026-08-05T04:34:17.292638Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.03523","last_updated":"2025-08-05T14:48:32Z","snapshot_observed_at":"2026-08-06T04:24:04.481518Z","submitted_at":"2025-08-05T14:48:32Z","title":"FilBench: Can LLMs Understand and Generate Filipino?","version":1},"cited_work":{"arxiv_id":"2508.03523","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.03523","snapshot_observed_at":"2026-08-05T04:34:15.210465Z","title":"FilBench: Can LLMs Understand and Generate Filipino?","venue":"cs.CL","work_id":"7aae5d80-23e2-4b6c-be8e-473c6c264491","year":2025},"citing_paper":{"arxiv_id":"2509.06065","last_updated":"2025-09-07T14:09:57Z","snapshot_observed_at":"2026-08-13T14:53:06.943743Z","submitted_at":"2025-09-07T14:09:57Z","title":"KatotohananQA: Evaluating Truthfulness of Large Language Models in Filipino","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T04:34:14.771236Z"},"links":{"cited_paper":"/paper/2508.03523","citing_paper":"/paper/2509.06065"},"observation_digest":"sha256:23e0d6543bfe5c8cc9df37cb84d45548ea9773752b0b71cbb0295c143b46f435","observation_id":"1fe44ee8-4816-4c0e-9982-b222143ee92b","resolution":{"observed_at":"2026-08-05T04:34:15.338813Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2003.11080","last_updated":"2020-09-04T17:56:31Z","snapshot_observed_at":"2026-08-14T10:23:46.767471Z","submitted_at":"2020-03-24T19:09:37Z","title":"XTREME: A Massively Multilingual Multi-task Benchmark for Evaluating Cross-lingual Generalization","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.11080","snapshot_observed_at":"2026-08-05T04:34:14.946810Z","title":"https://arxiv.org/abs/2003.11080","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2509.06065","last_updated":"2025-09-07T14:09:57Z","snapshot_observed_at":"2026-08-13T14:53:06.943743Z","submitted_at":"2025-09-07T14:09:57Z","title":"KatotohananQA: Evaluating Truthfulness of Large Language Models in Filipino","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T04:34:14.946810Z"},"links":{"cited_paper":"/paper/2003.11080","citing_paper":"/paper/2509.06065"},"observation_digest":"sha256:b0c4e8c7520044520a84b2a2b717f7f3463aa36a18a8e392486727802e48f84a","observation_id":"3536f4d6-026f-4973-843e-3bcd961e2bf7","resolution":{"observed_at":"2026-08-05T04:34:14.946810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:34:16.831883Z","title":"https://openai.com/ index/introducing-gpt-5/","venue":null,"work_id":"5721fcda-b55c-417d-a74f-45fa80ad1481","year":2025},"citing_paper":{"arxiv_id":"2509.06065","last_updated":"2025-09-07T14:09:57Z","snapshot_observed_at":"2026-08-13T14:53:06.943743Z","submitted_at":"2025-09-07T14:09:57Z","title":"KatotohananQA: Evaluating Truthfulness of Large Language Models in Filipino","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T04:34:15.067301Z"},"links":{"citing_paper":"/paper/2509.06065"},"observation_digest":"sha256:595e67d4c449c8d0b002c40cb8d373a85cdeba429553bcf30e0ab181b63f92c1","observation_id":"d1cd925b-b8aa-46e4-85e9-6b87305d7a85","resolution":{"observed_at":"2026-08-05T04:34:16.953587Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.06065","last_updated":"2025-09-07T14:09:57Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-13T14:53:06.943743Z","submitted_at":"2025-09-07T14:09:57Z","title":"KatotohananQA: Evaluating Truthfulness of Large Language Models in Filipino"},"reference_resolution":{"displayed":17,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":5,"verified_exact":3,"verified_fuzzy":8},"total_outbound_references":17},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 17 of 17 outbound references and 0 inbound Pith citation observations for arXiv:2509.06065."}