{"as_of":"2026-08-17T18:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7904e264510ae4a7ed079ef478d6f56c2088b531d3b4e8c5df8e9cff870575d1","coverage":[{"denominator":62,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":62,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T12:55:40.574784Z","state":"measured"},{"denominator":65,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":65,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T10:16:49.178190Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T10:23:02.033144Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13716","snapshot_observed_at":"2026-08-09T10:16:49.178190Z","title":"Model decides how to tokenize: Adaptive dna sequence tokenization with mxdna","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03499","last_updated":"2025-02-05T09:20:52Z","snapshot_observed_at":"2026-08-15T12:14:19.347538Z","submitted_at":"2025-02-05T09:20:52Z","title":"Omni-DNA: A Unified Genomic Foundation Model for Cross-Modal and Multi-Task Learning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-09T10:16:49.178190Z"},"links":{"cited_paper":"/paper/2412.13716","citing_paper":"/paper/2502.03499"},"observation_digest":"sha256:418340e14c4ec9a80df923b8b83da95975ab7b8a111198d5642ad463a35ff071","observation_id":"54c58040-082d-4fc1-bfc6-72ae83cfd73b","resolution":{"observed_at":"2026-08-09T10:16:49.178190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13716","snapshot_observed_at":"2026-08-09T00:42:57.108037Z","title":"Model decides how to tokenize: Adaptive dna sequence tokenization with mxdna","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04397","last_updated":"2025-06-29T03:09:34Z","snapshot_observed_at":"2026-08-16T06:22:16.768114Z","submitted_at":"2025-02-06T06:58:09Z","title":"Multimodal Medical Code Tokenizer","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-09T00:42:57.108037Z"},"links":{"cited_paper":"/paper/2412.13716","citing_paper":"/paper/2502.04397"},"observation_digest":"sha256:9d6e85244c842e1f4a97dc60d4371d54cbbec2498ea27752df1af87aee782000","observation_id":"68266149-a31b-4fca-8003-04989623e289","resolution":{"observed_at":"2026-08-09T00:42:57.108037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"cited_work":{"arxiv_id":"2412.13716","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.13716","snapshot_observed_at":"2026-08-07T10:23:02.033144Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","venue":"q-bio.GN","work_id":"e8952989-24e6-4626-95b5-1fab2f9c8696","year":2024},"citing_paper":{"arxiv_id":"2506.05542","last_updated":"2025-06-05T19:44:38Z","snapshot_observed_at":"2026-08-13T03:20:34.930786Z","submitted_at":"2025-06-05T19:44:38Z","title":"Agentomics-ML: Autonomous Machine Learning Experimentation Agent for Genomic and Transcriptomic Data","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T10:22:59.855577Z"},"links":{"cited_paper":"/paper/2412.13716","citing_paper":"/paper/2506.05542"},"observation_digest":"sha256:50454fea64ba4089b4b46ae72e89b46734b55e68f18c004747a4a3108d22f439","observation_id":"ebe9fc7f-fa4f-4d2b-a32e-00191f17e3d9","resolution":{"observed_at":"2026-08-07T10:23:02.080819Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.13716/citation-record","integrity":"/paper/2412.13716/integrity","json":"/paper/2412.13716/citation-record.json","paper":"/paper/2412.13716"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-08-14T18:16:28.847993Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-11T12:55:40.347551Z","title":"Bert: Pre-training of deep bidirec- tional transformers for language understanding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.347551Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:893760dfa1d970f5cf276ca4b5570f75f34bb8fe6a561c5b817f71eba0758397","observation_id":"adf20a5d-0e1e-4f6a-b885-ba74e95b579d","resolution":{"observed_at":"2026-08-11T12:55:40.347551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:55:40.352203Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.352203Z"},"links":{"citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:b82f05da46038bb3fa53aff882cb3f667d9a6c5a6aa1adc4e0f935d61975e8d5","observation_id":"96ccb9b7-169a-4329-a7a2-becced86e07b","resolution":{"observed_at":"2026-08-11T12:55:40.352203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-11T12:55:40.355727Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.355727Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:a695c47dda590b7222659782922b445f999f590b6d9759acfaad3a7803ca6d87","observation_id":"c1023c1d-a123-4f3b-bb74-137c2ceae6bb","resolution":{"observed_at":"2026-08-11T12:55:40.355727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:55:40.359080Z","title":"Dnabert: pre-trained bidirectional encoder representations from transformers model for dna-language in genome","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.359080Z"},"links":{"citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:2a5d21186c080ac2c92a768ea8d5cafacd4cc28b89f979fc24e532e5e44a3885","observation_id":"0343c83b-b6d0-4b3d-bc8d-be602420b5fa","resolution":{"observed_at":"2026-08-11T12:55:40.359080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.15006","last_updated":"2024-03-18T23:59:29Z","snapshot_observed_at":"2026-08-16T15:20:58.339539Z","submitted_at":"2023-06-26T18:43:46Z","title":"DNABERT-2: Efficient Foundation Model and Benchmark For Multi-Species Genome","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.15006","snapshot_observed_at":"2026-08-11T12:55:40.362299Z","title":"Dnabert-2: Efficient foundation model and benchmark for multi-species genome","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.362299Z"},"links":{"cited_paper":"/paper/2306.15006","citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:96c86f968134d0877403684bbb1447a3857eaf20cc12a348d16f79474072e9e2","observation_id":"a053cc48-3d4f-4380-bb47-2574e3b41884","resolution":{"observed_at":"2026-08-11T12:55:40.362299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:55:41.097473Z","title":"de Almeida, Hassan Sirelkha- tim, Guillaume Richard, Marcin Skwark, Karim Beguir, Marie Lopez, and Thomas Pierrot","venue":null,"work_id":"0cd8d3e8-6d73-4cad-b641-346e7d983faf","year":2023},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.365911Z"},"links":{"citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:c6a48118ea275c08c227c8c76b47433646211ad7b2df0b6ad8fd9ecbcdb5c5c5","observation_id":"2f04952a-743f-47fc-a4f3-34d724ef55a2","resolution":{"observed_at":"2026-08-11T12:55:41.101205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:55:40.369471Z","title":"Hyenadna: Long-range genomic sequence modeling at single nucleotide resolution","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.369471Z"},"links":{"citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:dd36283ad6ce2d912c639ee7ba3ece4531bb91af4d12879a90061ea24b1b10e6","observation_id":"c0c5fb7b-d119-4441-af72-091f61a2c035","resolution":{"observed_at":"2026-08-11T12:55:40.369471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:55:41.082342Z","title":"Linguistically inspired roadmap for building biologically reliable protein language models","venue":null,"work_id":"18f7abac-e999-4c58-9719-5cff98994c81","year":2023},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.372531Z"},"links":{"citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:b8f76c6e59bd75802f8b89b29a7c0ac566517e9b1ec2f7ff26c9843fb2d839f6","observation_id":"227e9583-5913-4b88-8371-903bf7d71271","resolution":{"observed_at":"2026-08-11T12:55:41.085878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.07644","last_updated":"2024-09-08T09:50:13Z","snapshot_observed_at":"2026-08-16T14:53:00.125919Z","submitted_at":"2023-10-11T16:40:57Z","title":"Toward Understanding BERT-Like Pre-Training for DNA Foundation Models","version":3},"cited_work":{"arxiv_id":"2310.07644","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.07644","snapshot_observed_at":"2026-08-11T12:55:40.759715Z","title":"Toward Understanding BERT-Like Pre-Training for DNA Foundation Models","venue":"cs.AI","work_id":"271e3a53-35d9-46dd-a798-6e38cd52db86","year":2023},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.376158Z"},"links":{"cited_paper":"/paper/2310.07644","citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:10e2fdc25b6a426c44429ba9975df767b3044007b1b441653d0a7def6061bac5","observation_id":"98b275a4-823e-4690-beb0-49a3e7cdd0dd","resolution":{"observed_at":"2026-08-11T12:55:40.765052Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.03720","last_updated":"2020-10-05T17:35:44Z","snapshot_observed_at":"2026-08-12T21:42:25.692663Z","submitted_at":"2020-04-07T21:21:06Z","title":"Byte Pair Encoding is Suboptimal for Language Model Pretraining","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.03720","snapshot_observed_at":"2026-08-11T12:55:40.380621Z","title":"Byte pair encoding is suboptimal for language model pretraining","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.380621Z"},"links":{"cited_paper":"/paper/2004.03720","citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:6255b2253b792b131c38ca3f7494ca3b617b4f78ccb8d5f17880e0ef9ec6787c","observation_id":"20b01f65-b8a3-4628-bffd-85c2448147b8","resolution":{"observed_at":"2026-08-11T12:55:40.380621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00403","last_updated":"2021-06-02T14:00:26Z","snapshot_observed_at":"2026-08-16T18:54:41.932428Z","submitted_at":"2021-01-02T08:36:48Z","title":"Superbizarre Is Not Superb: Derivational Morphology Improves BERT's Interpretation of Complex Words","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00403","snapshot_observed_at":"2026-08-11T12:55:40.384266Z","title":"Superbizarre is not superb: Derivational morphology improves bert’s interpretation of complex words","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.384266Z"},"links":{"cited_paper":"/paper/2101.00403","citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:fdad2e5debddf3eabd02e1eed6a3d5f5b5f6b7cede3d23be29dd2db4342274eb","observation_id":"63408308-2bc7-4487-a93c-60b8ed154614","resolution":{"observed_at":"2026-08-11T12:55:40.384266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:55:41.072278Z","title":"Unconstrained generation of synthetic antibody–antigen structures to guide machine learning methodology for antibody specificity prediction","venue":null,"work_id":"5e963984-21cb-4797-9406-f8dd2b034fb1","year":2022},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.387842Z"},"links":{"citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:029f4a2a3d69451fc430ebe5bf5000cd87bda48b26ac99196f9bac451ec5b063","observation_id":"d2ca6f03-68c3-4879-8781-7837c5c3c6f5","resolution":{"observed_at":"2026-08-11T12:55:41.076099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:55:41.062467Z","title":"A compact vocabulary of paratope-epitope interactions enables predictability of antibody-antigen binding","venue":null,"work_id":"196d0969-abf7-4e6f-a4c7-cdbe986a2988","year":2021},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.391237Z"},"links":{"citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:28ef738b34f6d8b6b3344d4c39956eedb3598a8fe7cf5f44db237528a7578862","observation_id":"71f7cc33-6739-461b-8d5f-f62a93a255ca","resolution":{"observed_at":"2026-08-11T12:55:41.066015Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:55:40.394414Z","title":"Central dogma of molecular biology","venue":null,"work_id":null,"year":1970},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.394414Z"},"links":{"citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:7a1e5a4f7446e1be19c204767f019a6fcb9547e05780c5a27653cb7e236f6a4a","observation_id":"36ee5187-cba8-48f4-bcda-1a611208da56","resolution":{"observed_at":"2026-08-11T12:55:40.394414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1701.06538","last_updated":"2017-01-23T18:10:00Z","snapshot_observed_at":"2026-08-13T11:35:07.866136Z","submitted_at":"2017-01-23T18:10:00Z","title":"Outrageously Large Neural Networks: The Sparsely-Gated Mixture-of-Experts Layer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.06538","snapshot_observed_at":"2026-08-11T12:55:40.397583Z","title":"Outrageously large neural networks: The sparsely-gated mixture-of-experts layer","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.397583Z"},"links":{"cited_paper":"/paper/1701.06538","citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:a11f1391a6767938a2f68b67d7ccd923626ad29f63acf96b45e310002d4bf2ce","observation_id":"2f0f97b8-d4a5-4471-b934-5d16c6230897","resolution":{"observed_at":"2026-08-11T12:55:40.397583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:55:40.401037Z","title":"Switch transformers: Scaling to trillion parameter models with simple and efficient sparsity","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.401037Z"},"links":{"citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:c5cc5b31845fcc55ea262900cadf26889dee32917719ef2b793c42041cddb7b2","observation_id":"0be5b152-b60c-4ffe-a73b-2efec330b66b","resolution":{"observed_at":"2026-08-11T12:55:40.401037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-08-13T19:43:49.936776Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-11T12:55:40.404253Z","title":"Mixtral of experts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.404253Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:56e778ed368b503c9a6e90d1c102753edc2dd6a295f5fc2e1a0d5141890ae6a3","observation_id":"614806e1-d8ae-459c-a26c-ca2c343a7208","resolution":{"observed_at":"2026-08-11T12:55:40.404253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:55:41.041072Z","title":"Deformable convolutional networks","venue":null,"work_id":"8ae93a19-5f19-4d11-8174-318d2a7ef71d","year":2017},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.407759Z"},"links":{"citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:428409ef8ff5de9cffe03e3a8edc8f13ec667ae9c812408fd64161d37eb3e3d1","observation_id":"59bf2de7-2fa0-445f-a393-bf9d95f32e84","resolution":{"observed_at":"2026-08-11T12:55:41.044498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:55:41.030811Z","title":"Deformable convnets v2: More deformable, better results","venue":null,"work_id":"cecfcdd5-3f76-4619-b854-d4e2d1269f58","year":2019},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.411248Z"},"links":{"citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:944a77e807d42c4562a6b453f1c5a7e33b07dc37f72e09d9043f4877b20452b2","observation_id":"3fd807a2-0241-41a0-9e43-bda2870f2af3","resolution":{"observed_at":"2026-08-11T12:55:41.034613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:55:41.020538Z","title":"Genomic benchmarks: a collection of datasets for genomic sequence classification","venue":null,"work_id":"7829bbd9-1bb6-41c1-a26c-4ced2fb9a70a","year":2023},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.414491Z"},"links":{"citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:2dbff3da9b119b87406b1c520c444292fed8c9ac155cf2a43d320e981463e03d","observation_id":"7cd9417a-3c93-47a4-9d97-1cdc3e36638d","resolution":{"observed_at":"2026-08-11T12:55:41.024150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:55:41.010475Z","title":"Character-aware neural language models","venue":null,"work_id":"1bcff850-af26-4f82-a915-109139264165","year":2016},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.417890Z"},"links":{"citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:eef0f1332244a90903d539d76209c7cf7c207530b209360bee2c16db6cac69b1","observation_id":"3e10a6ba-ab17-4c77-81e1-f55599267160","resolution":{"observed_at":"2026-08-11T12:55:41.014164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:55:40.421216Z","title":"Character-level language modeling with deeper self-attention","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.421216Z"},"links":{"citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:4fda2f9c81da75be14291859804107928ad078748ea3110738b05b1a540dc253","observation_id":"0663aba8-d91f-414f-9846-b3f1d3ec83d0","resolution":{"observed_at":"2026-08-11T12:55:40.421216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03234","last_updated":"2024-06-05T21:02:37Z","snapshot_observed_at":"2026-08-16T14:12:50.066934Z","submitted_at":"2024-03-05T01:42:51Z","title":"Caduceus: Bi-Directional Equivariant Long-Range DNA Sequence Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03234","snapshot_observed_at":"2026-08-11T12:55:40.424201Z","title":"Caduceus: Bi-directional equivariant long-range dna sequence modeling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.424201Z"},"links":{"cited_paper":"/paper/2403.03234","citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:d85ccaf962feea6ceaaae1d06f318ee7f990393269b2f1f0406afc0456f0d516","observation_id":"49f8210d-6aac-49de-a5ca-af7749ae835c","resolution":{"observed_at":"2026-08-11T12:55:40.424201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:55:40.427733Z","title":"Class-based n-gram models of natural language","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.427733Z"},"links":{"citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:0b15c82900d35b39cebfd1578b4da3efff26ad9f6f5a622d9c7fe5a22471c9bc","observation_id":"033151c5-1dd7-4ce3-a2db-d91108a6f9e8","resolution":{"observed_at":"2026-08-11T12:55:40.427733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:55:40.986773Z","title":"Character n-gram tokenization for european language text retrieval","venue":null,"work_id":"d659cda9-4b22-4296-b571-3645ae081efd","year":2004},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.431159Z"},"links":{"citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:b7dcefe99b7389038a9b1d3d05993fdbc486ce918e2ba99a86664d5fd5567e04","observation_id":"1725b71f-4503-475e-847f-fb45b583d6c2","resolution":{"observed_at":"2026-08-11T12:55:40.991377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:55:40.975743Z","title":"Dnagpt: A generalized pretrained tool for multiple dna sequence analysis tasks","venue":null,"work_id":"c2070a48-f81e-455a-96be-61a26fb249e7","year":2023},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.434223Z"},"links":{"citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:fa0658fb1831e48c68da41fb855ce01a541ce709cacb8625e8374ce2687c7331","observation_id":"de6cf4ef-d973-4008-bfc2-1e2d04b3c3fc","resolution":{"observed_at":"2026-08-11T12:55:40.980111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1508.07909","last_updated":"2016-06-10T14:45:08Z","snapshot_observed_at":"2026-08-17T07:28:37.146698Z","submitted_at":"2015-08-31T16:37:31Z","title":"Neural Machine Translation of Rare Words with Subword Units","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1508.07909","snapshot_observed_at":"2026-08-11T12:55:40.438931Z","title":"Neural machine translation of rare words with subword units","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.438931Z"},"links":{"cited_paper":"/paper/1508.07909","citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:069e6878a2bffb6f95030732f7f3c4e4ec4f7154f45033be50d4448f23c63403","observation_id":"5caeed51-0007-4ee3-8c0b-f20ee2a148db","resolution":{"observed_at":"2026-08-11T12:55:40.438931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:55:40.964788Z","title":"High-coverage whole-genome sequencing of the expanded 1000 genomes project cohort including 602 trios","venue":null,"work_id":"ad518883-983d-40d6-9798-3fa99a60f31e","year":2022},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.443536Z"},"links":{"citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:e7e1e96c3bf5babba76108ebf0f73ba95ca9748fcedd6e131146b3041d68f94b","observation_id":"54dd53c3-596c-4607-a572-cb7f98321f25","resolution":{"observed_at":"2026-08-11T12:55:40.968978Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-11T12:55:40.447528Z","title":"Mamba: Linear-time sequence modeling with selective state spaces","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.447528Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:b39efb5511ab6903862b20b9a1d2c9afb5c5502116cac8cbada398509fa298e1","observation_id":"548b1e24-3082-4dd6-9b57-bea456d7c720","resolution":{"observed_at":"2026-08-11T12:55:40.447528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:55:40.451961Z","title":"Neural discrete representation learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.451961Z"},"links":{"citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:2335aa856ee4a39a8c931adc07fe251cc8ba3f9768fced5112ea07d1ac977bf7","observation_id":"38540933-d599-49ab-a736-31daa58ac41f","resolution":{"observed_at":"2026-08-11T12:55:40.451961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.10812","last_updated":"2024-06-02T17:50:46Z","snapshot_observed_at":"2026-08-16T13:53:01.024090Z","submitted_at":"2024-05-13T20:15:03Z","title":"VQDNA: Unleashing the Power of Vector Quantization for Multi-Species Genomic Sequence Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.10812","snapshot_observed_at":"2026-08-11T12:55:40.455960Z","title":"Vqdna: Unleashing the power of vector quantization for multi-species genomic sequence modeling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.455960Z"},"links":{"cited_paper":"/paper/2405.10812","citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:af3a81e6902d7bae8f018281f7e02f165b5895fc02138731747917da918ec61e","observation_id":"17c9714b-a969-45b1-98ea-be6f86316724","resolution":{"observed_at":"2026-08-11T12:55:40.455960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:55:40.460328Z","title":"Evaluation of grch38 and de novo haploid genome assemblies demonstrates the enduring quality of the reference assembly","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.460328Z"},"links":{"citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:ec5e1300a0106b24655d7babb6b71db1f19593e09435a12d53d7b76da028c1e7","observation_id":"2f7b6a10-c70c-44e0-ae2b-7f594e9e7ca3","resolution":{"observed_at":"2026-08-11T12:55:40.460328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:55:40.464808Z","title":"Hyena hierarchy: Towards larger convolutional language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.464808Z"},"links":{"citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:9cea60874870267a811b6a1c17c287f82c3e58d0b2f023d1d9352ae96bb0e588","observation_id":"7750e028-29f0-48fb-9929-64c90753e852","resolution":{"observed_at":"2026-08-11T12:55:40.464808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:55:40.468527Z","title":"Generative pretraining from pixels","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.468527Z"},"links":{"citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:1b9235fffba71246097b489031a8d334fb7349b37c0875f89c8cf89ce7f70343","observation_id":"6ee214f2-8e14-4205-8d03-e96064ea4e51","resolution":{"observed_at":"2026-08-11T12:55:40.468527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-16T09:25:53.087782Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-11T12:55:40.471958Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.471958Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:5075c48bc4b3517e1626abd0e3377190e0ae168caa50317fd69ef449dc128696","observation_id":"eebd56d4-7f5b-4461-95d3-602fc33e4280","resolution":{"observed_at":"2026-08-11T12:55:40.471958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:55:40.475959Z","title":"Zero-shot text-to-image generation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.475959Z"},"links":{"citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:7cac8f76c9ee779ad4ed60df74df7342076a1dd5ee7e0a299101fe297ac9ea44","observation_id":"c1f83ec1-12a6-4d32-aef1-40d4cbe5cf71","resolution":{"observed_at":"2026-08-11T12:55:40.475959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.08254","last_updated":"2022-09-03T14:11:33Z","snapshot_observed_at":"2026-08-17T05:59:48.347864Z","submitted_at":"2021-06-15T16:02:37Z","title":"BEiT: BERT Pre-Training of Image Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.08254","snapshot_observed_at":"2026-08-11T12:55:40.479394Z","title":"Beit: Bert pre-training of image transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.479394Z"},"links":{"cited_paper":"/paper/2106.08254","citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:2dc8538438e067c6085cb369c22430ccfcc789da1a69792134b5bf2f23c66508","observation_id":"f4ce9722-1672-46cf-82d2-fa03f107322f","resolution":{"observed_at":"2026-08-11T12:55:40.479394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:55:40.483300Z","title":"Bottom-up and top-down attention for image captioning and visual question answering","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.483300Z"},"links":{"citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:5830c98c40009b727251f28a4bbd0f00e9367c39fc88ba37afbf48df792073f2","observation_id":"c411ea1e-98a0-40df-9cb7-be68020efbe0","resolution":{"observed_at":"2026-08-11T12:55:40.483300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:55:40.919341Z","title":"Multimodal pretraining unmasked: A meta-analysis and a unified framework of vision-and-language berts","venue":null,"work_id":"7867520f-543c-46d4-992b-b003f07b3649","year":2021},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.486691Z"},"links":{"citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:fd68a65619d8879338ed6dce3171123b33a02a1c25d64376a2b8e58ffabd3ae5","observation_id":"398af155-0664-4a74-bfaf-e41756590a1f","resolution":{"observed_at":"2026-08-11T12:55:40.923067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:55:40.490900Z","title":"Faster r-cnn: Towards real-time object detection with region proposal networks","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.490900Z"},"links":{"citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:25e0f63ff9dac78ec6a6bf95e30e987a6be267abd8db55d631de1f0fa040065f","observation_id":"223283a5-be74-4f15-a3b9-acf5aad8ee96","resolution":{"observed_at":"2026-08-11T12:55:40.490900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14327","last_updated":"2025-03-12T18:22:25Z","snapshot_observed_at":"2026-08-16T14:16:21.068983Z","submitted_at":"2024-02-22T06:47:44Z","title":"Subobject-level Image Tokenization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14327","snapshot_observed_at":"2026-08-11T12:55:40.494350Z","title":"Subobject-level image tokenization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.494350Z"},"links":{"cited_paper":"/paper/2402.14327","citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:948172ac165d835a6bd5b275620aa70ef03b97ce9fd3a9521af285a8bea3870c","observation_id":"10e95a37-320b-4efe-af4c-28803fea135b","resolution":{"observed_at":"2026-08-11T12:55:40.494350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17863","last_updated":"2024-02-27T19:54:42Z","snapshot_observed_at":"2026-08-16T14:14:46.201722Z","submitted_at":"2024-02-27T19:54:42Z","title":"Vision Transformers with Natural Language Semantics","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17863","snapshot_observed_at":"2026-08-11T12:55:40.498643Z","title":"Vision transformers with natural language semantics","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.498643Z"},"links":{"cited_paper":"/paper/2402.17863","citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:c30fea55ad39163dd5bc4cda40029be5f411dc85b78034565f71af83de0dc112","observation_id":"b3fb685d-9bdb-44b7-8288-55b186f82c8f","resolution":{"observed_at":"2026-08-11T12:55:40.498643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:55:40.503210Z","title":"Segment anything","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.503210Z"},"links":{"citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:9af78ea9b98ef436227f01c7b8efaae6a74a317434e38caa652c0792cd1b238a","observation_id":"28f38dbc-8ca1-434d-b37c-d74f6d035824","resolution":{"observed_at":"2026-08-11T12:55:40.503210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13412","last_updated":"2024-02-20T22:45:00Z","snapshot_observed_at":"2026-08-16T14:16:47.658795Z","submitted_at":"2024-02-20T22:45:00Z","title":"Scaling physics-informed hard constraints with mixture-of-experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13412","snapshot_observed_at":"2026-08-11T12:55:40.507185Z","title":"Scaling physics-informed hard constraints with mixture-of-experts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.507185Z"},"links":{"cited_paper":"/paper/2402.13412","citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:3906540bf4d9794e477ed31fd515ab7d89f8faf7a2844010fd84664968187daa","observation_id":"e07a8e91-60fd-47d8-935f-dd48942f3649","resolution":{"observed_at":"2026-08-11T12:55:40.507185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.08100","last_updated":"2020-05-16T20:56:25Z","snapshot_observed_at":"2026-08-15T19:06:16.181826Z","submitted_at":"2020-05-16T20:56:25Z","title":"Conformer: Convolution-augmented Transformer for Speech Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.08100","snapshot_observed_at":"2026-08-11T12:55:40.510711Z","title":"Conformer: Convolution-augmented transformer for speech recognition","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.510711Z"},"links":{"cited_paper":"/paper/2005.08100","citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:ccf49e56023b69becac245ce0a2de0db0784cb1f114ce74852c58ac042954057","observation_id":"f4494061-488f-40dd-81dd-7e3c85f032c4","resolution":{"observed_at":"2026-08-11T12:55:40.510711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:55:40.514306Z","title":"Cvt: Introducing convolutions to vision transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.514306Z"},"links":{"citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:534b6e77a4fdc0ea3f8aadf031ba5b31f95bf0e04b2faec592cf0f961ea43ea4","observation_id":"10284f4a-1580-4a51-a7d4-bb92a635595d","resolution":{"observed_at":"2026-08-11T12:55:40.514306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:55:40.891580Z","title":"Early convolutions help transformers see better","venue":null,"work_id":"bcefb3bb-5ae0-44e6-8449-7c0c09c63c37","year":2021},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.517554Z"},"links":{"citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:7638bea3ce610cba50628a94eb96c9a410ebf5436692035a87d91a4e6f43704c","observation_id":"6526c71e-6e77-4a94-9f98-06b6a6f9eca4","resolution":{"observed_at":"2026-08-11T12:55:40.895999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:55:40.520711Z","title":"Effective gene expression prediction from sequence by integrating long-range interactions","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.520711Z"},"links":{"citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:c091bdd1bee107ebf904d701bbbd318f430c244f65d56379f935cc1d3794c6fe","observation_id":"61363b4a-b239-42ee-9a90-004c907fff9c","resolution":{"observed_at":"2026-08-11T12:55:40.520711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:55:40.524862Z","title":"Roformer: Enhanced transformer with rotary position embedding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.524862Z"},"links":{"citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:dcb569b58669ab22ab8b0a70853c321ad53615e4813111bec6a628a8e3758a62","observation_id":"112ee4f8-b003-45db-9c15-855991b4a09c","resolution":{"observed_at":"2026-08-11T12:55:40.524862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.05202","last_updated":"2020-02-12T19:57:13Z","snapshot_observed_at":"2026-08-11T06:21:56.129166Z","submitted_at":"2020-02-12T19:57:13Z","title":"GLU Variants Improve Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.05202","snapshot_observed_at":"2026-08-11T12:55:40.528480Z","title":"Glu variants improve transformer","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.528480Z"},"links":{"cited_paper":"/paper/2002.05202","citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:a50999daa8dd848ef7b0368e13974448b220d434df35e0d77b27e176cbd75948","observation_id":"0ca6c11d-4ab1-46c3-85ca-9b11ae2bd8a4","resolution":{"observed_at":"2026-08-11T12:55:40.528480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:55:40.533028Z","title":"Palm: Scaling language modeling with pathways","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.533028Z"},"links":{"citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:cbc9f21370becdb886598e7ec8fa1322b6eeb263a4f797cdf1712e6b91d14f5b","observation_id":"b0c40b5d-6265-486e-a649-53051191d6db","resolution":{"observed_at":"2026-08-11T12:55:40.533028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:55:40.536354Z","title":"Flashattention: Fast and memory-efficient exact attention with io-awareness","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.536354Z"},"links":{"citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:cf86296f0c3990cd42fbaf74598e8c4482ec6bffa2fd6ceb3914952343c2062e","observation_id":"962c133b-2c4d-4c85-8368-35fcb6ff3d42","resolution":{"observed_at":"2026-08-11T12:55:40.536354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08691","last_updated":"2023-07-17T17:50:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-17T17:50:36Z","title":"FlashAttention-2: Faster Attention with Better Parallelism and Work Partitioning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08691","snapshot_observed_at":"2026-08-11T12:55:40.540437Z","title":"Flashattention-2: Faster attention with better parallelism and work partitioning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.540437Z"},"links":{"cited_paper":"/paper/2307.08691","citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:863b4b27ef014f2f78427174efc78257af9747c786dd07b38fa1355e4f7cb828","observation_id":"86ba2652-d4fe-469f-87f2-280e2a026a0b","resolution":{"observed_at":"2026-08-11T12:55:40.540437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:55:40.859277Z","title":"PyTorch 2: Faster Machine Learning Through Dynamic Python Bytecode Transformation and Graph Compilation","venue":null,"work_id":"a8d03d67-a517-4de2-add6-702f58f883b7","year":2024},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.544019Z"},"links":{"citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:1004938b785d06f32b819c43fe63179a935e929e6720a9d2725c9608df288138","observation_id":"dcf7c438-aa73-448e-a718-ca7a873fc761","resolution":{"observed_at":"2026-08-11T12:55:40.862765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:55:40.850086Z","title":"PyTorch Lightning, March 2019","venue":null,"work_id":"cd41986f-3280-4ce4-b435-9aaba19f8128","year":2019},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.547507Z"},"links":{"citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:c9ef5b8197194ad9b5f1ac0cc7f47eeea0863fbd243e86e977efb569bef3ee2e","observation_id":"b0e6f61c-6360-4a71-9d15-aac413da8ee4","resolution":{"observed_at":"2026-08-11T12:55:40.853331Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:55:40.551231Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.551231Z"},"links":{"citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:b7ad90297bf0eada6f9b9227c8937fbd91bd667f9955b6a7949b6bb5eaf67521","observation_id":"cad24a14-2895-4245-91d5-4ea2287dd92e","resolution":{"observed_at":"2026-08-11T12:55:40.551231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:55:40.554545Z","title":"pybind11 – seamless operability between c++11 and python, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.554545Z"},"links":{"citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:19c725bf02fb627180a067119d71ce8fef3c290f57f9abc569a917a0d36c0810","observation_id":"0b20f5e8-61b2-419a-8486-4f2b454cfdef","resolution":{"observed_at":"2026-08-11T12:55:40.554545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:55:40.558478Z","title":"Pedregosa, G","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.558478Z"},"links":{"citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:a3e4c0acfd5205e4b81a8862539e52352aa5fb5327889b98d4fc83da1fbe8df4","observation_id":"be6885a0-f91a-42ce-a694-804c7596a59d","resolution":{"observed_at":"2026-08-11T12:55:40.558478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:55:40.563119Z","title":"Harris, K","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.563119Z"},"links":{"citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:d23a35775719b39a0c344062a32b2aaa139146f691a102e299c75596cb87a7f8","observation_id":"a0ab5825-0e40-4ab8-886b-0bf3d0249f86","resolution":{"observed_at":"2026-08-11T12:55:40.563119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:55:40.818284Z","title":null,"venue":null,"work_id":"d6b61e69-a2bc-40e9-850b-a4bee6dcf26d","year":2007},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.566375Z"},"links":{"citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:57871aca346a3911331f98afa95963dec4515a153791711ec53af6043cd9279b","observation_id":"35b57e7f-6ac5-4714-99e2-bc0174190c76","resolution":{"observed_at":"2026-08-11T12:55:40.821524Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:55:40.807991Z","title":"1-mer” stands for single nucleotide. “Ovlp 6-mer","venue":null,"work_id":"fcd3dbfe-fa57-4096-b3f5-228bad328c2f","year":2021},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.570202Z"},"links":{"citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:eedf53676d632c9c9f8f1421d366cab77c0c13308768f521d8230b633616dea9","observation_id":"067297f9-871f-44e9-a133-37c46ab24599","resolution":{"observed_at":"2026-08-11T12:55:40.811549Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:55:40.798394Z","title":null,"venue":null,"work_id":"3b25bf64-e064-4ec1-a700-0a80a99cd9c5","year":null},"citing_paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA","version":1},"reference_index":510,"source":"pdf_text","source_observed_at":"2026-08-11T12:55:40.574784Z"},"links":{"citing_paper":"/paper/2412.13716"},"observation_digest":"sha256:76412ac7f63d9c3cb374012854b9486950307a46a0c91194c9a5bc07a5503c54","observation_id":"2eb340a1-b443-4b4d-86e2-cc2b084d7f47","resolution":{"observed_at":"2026-08-11T12:55:40.801617Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.13716","last_updated":"2024-12-18T10:55:43Z","latest_version":1,"primary_category":"q-bio.GN","snapshot_observed_at":"2026-08-13T03:19:46.049847Z","submitted_at":"2024-12-18T10:55:43Z","title":"Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNA"},"reference_resolution":{"displayed":62,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":45,"verified_exact":1,"verified_fuzzy":16},"total_outbound_references":62},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 62 of 62 outbound references and 3 inbound Pith citation observations for arXiv:2412.13716."}