{"as_of":"2026-08-16T04:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4ec2860a98a5ff188f74c7ea3aded29fe691ebef251bcbe2732b5ff4b7d7cbca","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T20:56:15.620948Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.09242/citation-record","integrity":"/paper/2411.09242/integrity","json":"/paper/2411.09242/citation-record.json","paper":"/paper/2411.09242"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:15.352187Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.352187Z"},"links":{"citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:71ac26c747dcee6c941ef84964eb9bcc4f850533354fa0c6fffd194e94942b12","observation_id":"8c46a14b-1056-44cc-81f3-b66999537102","resolution":{"observed_at":"2026-08-12T20:56:15.352187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:16.872997Z","title":"GPT-NeoX: Large Scale Autoregressive Language Modeling in PyTorch , 9 2023","venue":null,"work_id":"abb46de7-78c4-438b-ba8a-e093d9efcfbe","year":2023},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.358037Z"},"links":{"citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:091aa0a3b72b4304d6fe0f562d6ce188b533357d3eabb8f3892f21f49ed2621e","observation_id":"67ddb99e-1cbf-4df8-9ae1-2784b73a2ecf","resolution":{"observed_at":"2026-08-12T20:56:16.878701Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2003.00532","last_updated":"2020-03-01T17:44:08Z","snapshot_observed_at":"2026-08-15T12:54:29.227334Z","submitted_at":"2020-03-01T17:44:08Z","title":"High Performance Code Generation in MLIR: An Early Case Study with GEMM","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.00532","snapshot_observed_at":"2026-08-12T20:56:15.363489Z","title":"High performance code generation in MLIR: an early case study with GEMM","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.363489Z"},"links":{"cited_paper":"/paper/2003.00532","citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:488b93303d2a47a030525c65c3e9a40665517548198837a84bc8d72edcbf09b7","observation_id":"4a371ee6-a733-4e5e-b3d7-2a65a34d81a2","resolution":{"observed_at":"2026-08-12T20:56:15.363489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:16.849303Z","title":"The slab allocator: an object-caching kernel memory allocator","venue":null,"work_id":"522bd3ce-8c95-4463-825c-eb079a370128","year":1994},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.370423Z"},"links":{"citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:75600940fc03bb404e4075ed3ea8d65151593562fe82311e2352b59974b5b52d","observation_id":"f0d28679-13a3-4408-b167-bf29d096d115","resolution":{"observed_at":"2026-08-12T20:56:16.857233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:15.375817Z","title":"J., Leary, C., Maclaurin, D., Necula, G., Paszke, A., Vander P las, J., Wanderman- M ilne, S., and Zhang, Q","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.375817Z"},"links":{"citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:1002e88c6323bf546f0c2dfe0f978586bc3b4d89bbc39dabfae840b9fb873ec4","observation_id":"ba640ada-42f8-4be8-bdcd-296794f8006e","resolution":{"observed_at":"2026-08-12T20:56:15.375817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1802.04799","last_updated":"2018-10-05T18:47:38Z","snapshot_observed_at":"2026-08-15T02:27:40.598046Z","submitted_at":"2018-02-12T20:49:34Z","title":"TVM: An Automated End-to-End Optimizing Compiler for Deep Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.04799","snapshot_observed_at":"2026-08-12T20:56:15.381198Z","title":"Q., Wang, L., Hu, Y., Ceze, L., Guestrin, C., and Krishnamurthy, A","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.381198Z"},"links":{"cited_paper":"/paper/1802.04799","citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:6ef85938db43f575bcf33cd915e91817ec675a0a05ddf8a5bcf3c1a3274d1bc8","observation_id":"35733c97-50cf-4b60-b5e6-f7310f69d9d3","resolution":{"observed_at":"2026-08-12T20:56:15.381198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:15.387520Z","title":null,"venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.387520Z"},"links":{"citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:653d7d9e85ad2c32e8de7caf60df44506a2dff1f3dce0d7a6f89a7b64094029c","observation_id":"e2cac0c7-83e4-447c-9e2a-aa4d963e85af","resolution":{"observed_at":"2026-08-12T20:56:15.387520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:16.814361Z","title":"Intel(r) math kernel library for deep neural networks (intel(r) mkl-dnn)","venue":null,"work_id":"a7e8dc4a-efbe-4bcb-9a2c-43ebee51932a","year":null},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.392551Z"},"links":{"citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:789757023fc163d9cc63a272d6f4f26857e8919bdd988696398be37b82cb8845","observation_id":"60b706b7-3ec3-4e60-80e3-3799153b1ffa","resolution":{"observed_at":"2026-08-12T20:56:16.820009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.08678","last_updated":"2021-03-13T13:41:01Z","snapshot_observed_at":"2026-07-06T10:05:19.828232Z","submitted_at":"2020-10-17T00:44:30Z","title":"TensorFlow Lite Micro: Embedded Machine Learning on TinyML Systems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.08678","snapshot_observed_at":"2026-08-12T20:56:15.397594Z","title":"J., Jeffries, N., Li, J., Kreeger, N., Nappier, I., Natraj, M., Regev, S., Rhodes, R., Wang, T., and Warden, P","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.397594Z"},"links":{"cited_paper":"/paper/2010.08678","citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:6e43e2f7fea1a77c8baf09543a9d9d9364f1413624b2bb34cc8fdfa467282e85","observation_id":"8ff634b7-3931-496e-b56f-49dffeac24c3","resolution":{"observed_at":"2026-08-12T20:56:15.397594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:16.796258Z","title":"Tensorflow lite micro: Embedded machine learning for tinyml systems","venue":null,"work_id":"846d0805-a4cc-457d-873f-84f77663b3cd","year":2021},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.402724Z"},"links":{"citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:a02c09e2246224721ad885fb876b8d469fbae6d77efc8efc3ca96d73bbe12d75","observation_id":"9e0dda72-379b-451d-9e03-21bb2eb33b8b","resolution":{"observed_at":"2026-08-12T20:56:16.802748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:16.776806Z","title":null,"venue":null,"work_id":"199ee6e8-f60c-4fff-a78d-a6f8244662ad","year":2021},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.408043Z"},"links":{"citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:4d7d34eccc09d447f1fe786724ac56e3164ed8fec4b7bff300350120b62d4bd1","observation_id":"6d102845-b61d-4a27-a197-b8df7e7fb21f","resolution":{"observed_at":"2026-08-12T20:56:16.782712Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-08-14T18:16:28.847993Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-12T20:56:15.412985Z","title":"BERT: pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.412985Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:b89dce0ebfa94b10a64d0399fab58bdf4cbb10413bd144dd911617b066f015f6","observation_id":"7bb98dc0-72c8-4adf-a419-8b276598b219","resolution":{"observed_at":"2026-08-12T20:56:15.412985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:16.757816Z","title":"Algorithms for compile-time memory optimization","venue":null,"work_id":"0fd9d0c4-924f-406c-be66-68ae40ae008b","year":1999},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.418619Z"},"links":{"citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:88c03af5be3193b84bbd14f7d8be4df116d567153098cca67c850a57ec651a20","observation_id":"a7921ea0-f8ae-4312-a12f-90cf00bbc586","resolution":{"observed_at":"2026-08-12T20:56:16.763065Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:16.737791Z","title":null,"venue":null,"work_id":"734c45b4-007a-43ce-b9ab-bbb503838309","year":null},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.423361Z"},"links":{"citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:fce219cf85f4669211b90a8328abc233d2213f76491a19c5134a1c6b277d1151","observation_id":"8a9c8a04-cd6f-4927-a43d-cb41d951dbcb","resolution":{"observed_at":"2026-08-12T20:56:16.743662Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:15.428402Z","title":"and Geijn, R","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.428402Z"},"links":{"citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:bc41a10aea900bad0bd3008a35be411ba0d04906e2a4bd824bf4f597fa434498","observation_id":"ab60ea0e-a3ba-4910-a915-cdc994f06cc6","resolution":{"observed_at":"2026-08-12T20:56:15.428402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/11558958_2","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-13T11:03:48.094449Z","title":null,"venue":"Lecture notes in computer science","work_id":"75df9876-5978-4c96-94f3-20aec98edb0e","year":2004},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.433277Z"},"links":{"citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:672feac871b81012f011d021cfb3bff10ba5d49fad4ec00c04a121058ff07ff5","observation_id":"c6efccda-0494-45be-95ab-ca700345e725","resolution":{"observed_at":"2026-08-12T20:56:15.676860Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1510.00149","last_updated":"2016-02-15T06:25:40Z","snapshot_observed_at":"2026-08-04T16:59:47.843960Z","submitted_at":"2015-10-01T09:03:44Z","title":"Deep Compression: Compressing Deep Neural Networks with Pruning, Trained Quantization and Huffman Coding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1510.00149","snapshot_observed_at":"2026-08-12T20:56:15.438510Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.438510Z"},"links":{"cited_paper":"/paper/1510.00149","citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:0a530aefcca03d8a88241f054e9072c011eb9e988a01c3400b96572dc48fd74c","observation_id":"e013fa76-f195-47ba-8175-c2b45a6a39ca","resolution":{"observed_at":"2026-08-12T20:56:15.438510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-08-14T22:57:08.956233Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-12T20:56:15.443882Z","title":"E., Vinyals, O., and Dean, J","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.443882Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:ca6744b815d486610de224367d6cdf76dcbebe89755453a6381da6da1ac138b2","observation_id":"330c517a-6c1b-4ce8-8a1b-4e1dfa0b060e","resolution":{"observed_at":"2026-08-12T20:56:15.443882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:16.720021Z","title":null,"venue":null,"work_id":"cd535377-b389-4b41-980f-10888e153488","year":2024},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.450501Z"},"links":{"citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:fc686bf8d7bb265ec980ca9e9b2ddcc7cf9a86fcc6efdd57cc5908b4f5ce520c","observation_id":"ec94146e-6de9-4959-97f2-88dbe04eb24c","resolution":{"observed_at":"2026-08-12T20:56:16.725128Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:16.703383Z","title":"Openvino","venue":null,"work_id":"7ea6d042-c925-43a0-be00-4f0f42647294","year":null},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.455286Z"},"links":{"citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:db97b0c8bbc46c56957ffc30706b41239479720b7e9a72cde5b24dda2438c4f9","observation_id":"47a0e427-e4dc-4539-9b3a-4b2a3a4a5a33","resolution":{"observed_at":"2026-08-12T20:56:16.708624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.02496","last_updated":"2021-02-02T11:11:28Z","snapshot_observed_at":"2026-08-06T10:31:27.632134Z","submitted_at":"2020-08-06T07:43:19Z","title":"ConvBERT: Improving BERT with Span-based Dynamic Convolution","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.02496","snapshot_observed_at":"2026-08-12T20:56:15.460527Z","title":"Convbert: Improving BERT with span-based dynamic convolution","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.460527Z"},"links":{"cited_paper":"/paper/2008.02496","citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:c06f70e4c03c1ad418a09c05ad7c5228f36598fe2c12c680bde244aaea70bf4e","observation_id":"54873ebe-6de1-4abc-afe2-11d86425316a","resolution":{"observed_at":"2026-08-12T20:56:15.460527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.05615","last_updated":"2021-01-13T00:34:04Z","snapshot_observed_at":"2026-08-09T20:26:18.725498Z","submitted_at":"2021-01-13T00:34:04Z","title":"FBGEMM: Enabling High-Performance Low-Precision Deep Learning Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.05615","snapshot_observed_at":"2026-08-12T20:56:15.466664Z","title":"S., Huang, J., Basu, P., Deng, S., Liu, H., Park, J., and Smelyanskiy, M","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.466664Z"},"links":{"cited_paper":"/paper/2101.05615","citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:7238d500c45e97897061c1a02483e33f7e207acd1e663f96bde5d45f0a5fe0cc","observation_id":"d3266c7c-d358-4813-83ac-b72e9fd23524","resolution":{"observed_at":"2026-08-12T20:56:15.466664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:16.686900Z","title":"W., and Keutzer, K","venue":null,"work_id":"84fc3a99-266e-40ba-8dc4-b93a9e830a7e","year":2021},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.471845Z"},"links":{"citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:6adc0cdd76b0ff46753b5dc5a65156f9199d6d72b987c7cef888cde475d2b080","observation_id":"b0647653-e7a9-4bb6-aef9-ce4697c75ab2","resolution":{"observed_at":"2026-08-12T20:56:16.692107Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:16.669195Z","title":null,"venue":null,"work_id":"49498cea-a986-41f3-8d42-0efbfbeac9cb","year":1997},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.476719Z"},"links":{"citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:df0d6b1902e24a18e7fd9c61b3e0d53ecb8042654b5998c89bb8bd7b3dc9a141","observation_id":"0204436d-8b31-4502-83f9-59772d9e8992","resolution":{"observed_at":"2026-08-12T20:56:16.674612Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06601","last_updated":"2018-01-19T23:39:15Z","snapshot_observed_at":"2026-08-14T19:53:38.140071Z","submitted_at":"2018-01-19T23:39:15Z","title":"CMSIS-NN: Efficient Neural Network Kernels for Arm Cortex-M CPUs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06601","snapshot_observed_at":"2026-08-12T20:56:15.481470Z","title":"CMSIS-NN: efficient neural network kernels for arm cortex-m cpus","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.481470Z"},"links":{"cited_paper":"/paper/1801.06601","citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:77d6406ed1d8d7c0af83b3a79cc1676585a8f025cfb1d268767b990fb49f4ea3","observation_id":"29196095-6593-4a14-8ddd-c66b900bb85b","resolution":{"observed_at":"2026-08-12T20:56:15.481470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.11054","last_updated":"2020-03-01T00:38:46Z","snapshot_observed_at":"2026-08-15T17:18:59.163433Z","submitted_at":"2020-02-25T17:24:50Z","title":"MLIR: A Compiler Infrastructure for the End of Moore's Law","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.11054","snapshot_observed_at":"2026-08-12T20:56:15.486087Z","title":"A., Amini, M., Bondhugula, U., Riddle, R., Cohen, A., Shpeisman, T., Davis, A., Vasilache, N., and Zinenko, O","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.486087Z"},"links":{"cited_paper":"/paper/2002.11054","citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:4d0d06b96175170f72d64da308f4310679b78a96263a0fbf3c0292b1234e0f90","observation_id":"75fe1ef6-a324-49c9-8f69-17b1186b8030","resolution":{"observed_at":"2026-08-12T20:56:15.486087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:15.491457Z","title":"MLIR : Scaling compiler infrastructure for domain specific computation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.491457Z"},"links":{"citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:68cbf8c8cbb4d85f2783c5dd209a0ab7492ae944b81db59767cdcb3eea7c0e97","observation_id":"8e905d47-f3a4-4035-837d-b946e51f15c1","resolution":{"observed_at":"2026-08-12T20:56:15.491457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2008.08272","last_updated":"2020-10-01T01:15:28Z","snapshot_observed_at":"2026-08-10T22:39:45.878362Z","submitted_at":"2020-08-19T05:28:08Z","title":"Compiling ONNX Neural Network Models Using MLIR","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.08272","snapshot_observed_at":"2026-08-12T20:56:15.495894Z","title":"D., Bercea, G., Chen, T., Eichenberger, A","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.495894Z"},"links":{"cited_paper":"/paper/2008.08272","citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:7ca2231a93bd2297a06b2ecf5edc9b436e62d954213bf4a8836513b438a7700e","observation_id":"867c6d68-25de-4b0d-9dcd-11f0f7f0c093","resolution":{"observed_at":"2026-08-12T20:56:15.495894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.01989","last_updated":"2019-07-03T15:23:20Z","snapshot_observed_at":"2026-08-14T16:09:05.946975Z","submitted_at":"2019-07-03T15:23:20Z","title":"On-Device Neural Net Inference with Mobile GPUs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.01989","snapshot_observed_at":"2026-08-12T20:56:15.500865Z","title":"On-device neural net inference with mobile gpus","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.500865Z"},"links":{"cited_paper":"/paper/1907.01989","citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:478a83ac190773807bd1dd7e252701efcec1d5cb18d0a3d20859841f80fe5604","observation_id":"2a0f5617-e628-427f-8c59-a7f86c1579a8","resolution":{"observed_at":"2026-08-12T20:56:15.500865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.15352","last_updated":"2024-04-03T03:12:53Z","snapshot_observed_at":"2026-08-15T03:25:57.445392Z","submitted_at":"2021-10-28T17:58:45Z","title":"MCUNetV2: Memory-Efficient Patch-based Inference for Tiny Deep Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.15352","snapshot_observed_at":"2026-08-12T20:56:15.506081Z","title":"Mcunetv2: Memory-efficient patch-based inference for tiny deep learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.506081Z"},"links":{"cited_paper":"/paper/2110.15352","citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:ca2fc03d280fe61b8cda25e9ca570821a8ff1e0612d2cb2aedb21e974e48dd6b","observation_id":"fd8231fb-ed7e-4a60-917d-9c73b56192eb","resolution":{"observed_at":"2026-08-12T20:56:15.506081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:15.511170Z","title":"and Deng, W","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.511170Z"},"links":{"citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:3a15badaec7028974071b6a0935a2a8d2592f0a0420519d723868daf749613ca","observation_id":"dc4f2966-590c-4e7e-aaf0-b1f1d064f4ad","resolution":{"observed_at":"2026-08-12T20:56:15.511170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:16.652384Z","title":"Optimizing CNN model inference on CPUs","venue":null,"work_id":"d4ca2c04-74c4-4980-9b23-af3e8d3b3dd6","year":2019},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.516050Z"},"links":{"citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:ff1329d458db0ab425550f002d0fc6d68c763653ee6bc6ce5fd8714322de141e","observation_id":"9f86e7b1-706e-4333-960f-05d662e9c11b","resolution":{"observed_at":"2026-08-12T20:56:16.657661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:15.520957Z","title":"Rammer: Enabling holistic deep learning compiler optimizations with rTasks","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.520957Z"},"links":{"citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:fd009ec60c2ad2ccc00f326d5590f6c1032b504e11f17be634d9f640ddff5b0a","observation_id":"4b5caed0-8a29-4675-bb2f-cfc91d4af710","resolution":{"observed_at":"2026-08-12T20:56:15.520957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:16.623120Z","title":null,"venue":null,"work_id":"a4269883-da5a-4eeb-b1c1-6a261e0ed5bc","year":null},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.525990Z"},"links":{"citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:4057d65d4f1199b520ea0d32fc9095e42080c25c488b5ebb7654e7ca9d0e587a","observation_id":"fa0c3e2f-d18e-493c-ba61-766a99ef7dae","resolution":{"observed_at":"2026-08-12T20:56:16.628490Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"5992.81465","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:16.055154Z","title":null,"venue":null,"work_id":"e1d87f90-e10b-4d37-b278-df9a87edafdb","year":2000},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.531651Z"},"links":{"citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:dd6c772e50e2795d4bab1868147e794e0550d3ea49e0f63ff02d3c80efaf2649","observation_id":"11a49a10-119a-4226-bb22-260ccd0aad17","resolution":{"observed_at":"2026-08-12T20:56:16.063895Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:16.606998Z","title":"Tensorrt","venue":null,"work_id":"f7087bea-1001-4a97-b683-dbe8afa86db2","year":null},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.536508Z"},"links":{"citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:a5282525fbe0fee07bb94fe99a765f497193a26144f63e317ad39cbe56cfd8b0","observation_id":"a3969b7f-7fca-457e-95a5-da03fa5cc8e7","resolution":{"observed_at":"2026-08-12T20:56:16.611754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.01703","last_updated":"2019-12-03T22:06:05Z","snapshot_observed_at":"2026-07-06T08:41:49.632205Z","submitted_at":"2019-12-03T22:06:05Z","title":"PyTorch: An Imperative Style, High-Performance Deep Learning Library","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.01703","snapshot_observed_at":"2026-08-12T20:56:15.541507Z","title":"Z., DeVito, Z., Raison, M., Tejani, A., Chilamkurthy, S., Steiner, B., Fang, L., Bai, J., and Chintala, S","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.541507Z"},"links":{"cited_paper":"/paper/1912.01703","citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:7dc388129917b2c0150124b9bc6cbddcea40d5a70ab2d658dbc2ae10b1c868a0","observation_id":"3a37fea0-d617-4a59-9ac2-5226e0d6a1d4","resolution":{"observed_at":"2026-08-12T20:56:15.541507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.03288","last_updated":"2020-02-16T02:32:54Z","snapshot_observed_at":"2026-08-08T07:04:45.414363Z","submitted_at":"2020-01-10T02:45:41Z","title":"Efficient Memory Management for Deep Neural Net Inference","version":3},"cited_work":{"arxiv_id":"2001.03288","doi":null,"metadata_source":"pith","pith_arxiv_id":"2001.03288","snapshot_observed_at":"2026-08-12T20:56:15.967596Z","title":"Efficient Memory Management for Deep Neural Net Inference","venue":"cs.LG","work_id":"b005e56c-2fbe-408d-8156-54f5bd21e8f9","year":2020},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.546977Z"},"links":{"cited_paper":"/paper/2001.03288","citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:45e5f4feb2402213420bd8e7e7ae74317c3bd7f7e2722b236cc26989338b4f0d","observation_id":"f52dbcd3-e8e0-4f12-a81e-859755eea8d2","resolution":{"observed_at":"2026-08-12T20:56:15.973118Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:15.552456Z","title":"Halide: a language and compiler for optimizing parallelism, locality, and recomputation in image processing pipelines","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.552456Z"},"links":{"citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:200b9206edb9a2811b38b236a63b69e1fe77b89c023ff31b54da21f4d5e99f72","observation_id":"b8ccd284-3882-4be1-899b-067239ed600e","resolution":{"observed_at":"2026-08-12T20:56:15.552456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.00907","last_updated":"2019-04-03T19:54:50Z","snapshot_observed_at":"2026-08-14T19:19:35.102244Z","submitted_at":"2018-05-02T17:04:53Z","title":"Glow: Graph Lowering Compiler Techniques for Neural Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.00907","snapshot_observed_at":"2026-08-12T20:56:15.558547Z","title":"Glow: Graph lowering compiler techniques for neural networks","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.558547Z"},"links":{"cited_paper":"/paper/1805.00907","citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:375a42cdac0fa82d81d28e0764c117fa75c2305e67669d40747875c54b899623","observation_id":"61996e79-8239-4cac-94e3-19e8a18c9c0d","resolution":{"observed_at":"2026-08-12T20:56:15.558547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:16.589762Z","title":"Xla : Compiling machine learning for peak performance, 2020","venue":null,"work_id":"8baa2da9-ca5f-46f6-92ed-4623f793c571","year":2020},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.563876Z"},"links":{"citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:818bf3b28807f97bd4e3be1ea27a78d0380a5b35e2322d64a0d8b7f05da7e3be","observation_id":"af7e3904-88dc-4e36-9328-81398812238f","resolution":{"observed_at":"2026-08-12T20:56:16.594812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.06732","last_updated":"2022-03-14T10:35:35Z","snapshot_observed_at":"2026-08-14T10:35:34.660420Z","submitted_at":"2020-09-14T20:38:14Z","title":"Efficient Transformers: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.06732","snapshot_observed_at":"2026-08-12T20:56:15.569068Z","title":"Efficient transformers: A survey","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.569068Z"},"links":{"cited_paper":"/paper/2009.06732","citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:80aa2fae29f7f2b79083b8297ff03ca74716650756cd73e8c6d72c6204a0e79d","observation_id":"c954bb67-6291-4847-b3c3-0945b98bf92e","resolution":{"observed_at":"2026-08-12T20:56:15.569068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:16.574578Z","title":"IREE , September 2019","venue":null,"work_id":"11ed3944-394a-4012-aeed-d0e37a2beb79","year":2019},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.574702Z"},"links":{"citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:18f4a33fa2b824857dc83a714290194254db3f314be1111020107d2bdee7fe0b","observation_id":"a777bded-2662-4b06-8289-855dd326dab3","resolution":{"observed_at":"2026-08-12T20:56:16.579026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03762","last_updated":"2023-08-02T00:41:18Z","snapshot_observed_at":"2026-08-15T23:59:39.932635Z","submitted_at":"2017-06-12T17:57:34Z","title":"Attention Is All You Need","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.03762","snapshot_observed_at":"2026-08-12T20:56:15.579575Z","title":"N., Kaiser, L., and Polosukhin, I","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.579575Z"},"links":{"cited_paper":"/paper/1706.03762","citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:cdf90063eb335ed7c21e365fae156f89661d0bfdb055e2c8255381ac3db6ded2","observation_id":"363f2bf0-1ae2-457f-82bf-79e47cab334d","resolution":{"observed_at":"2026-08-12T20:56:15.579575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:15.584899Z","title":"Augem: Automatically generate high performance dense linear algebra kernels on x86 cpus","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.584899Z"},"links":{"citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:c1595218033130441b6ead1da2a39952188d69f3534b7b90f4aa0326e26d8842","observation_id":"c7855c6d-940a-4e13-a323-193a0f8ade81","resolution":{"observed_at":"2026-08-12T20:56:15.584899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:16.559212Z","title":null,"venue":null,"work_id":"ccf2a858-2547-4b99-b492-1412af739b62","year":1998},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.589890Z"},"links":{"citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:025b2cf66249d9a0d0c761ab04ea8c707bc10fc83d7a6b0d1e9a53a253fc7b8f","observation_id":"51ffc36d-2cdd-4f0f-ac66-1aa7e8a9dca7","resolution":{"observed_at":"2026-08-12T20:56:16.563719Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:15.595781Z","title":"Model-driven level 3 blas performance optimization on loongson 3a processor","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.595781Z"},"links":{"citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:2b8d6180c28daf7c1017baa92fe84f18b9659385e851726342e717152aeb7abb","observation_id":"67f7592a-28c4-406a-909f-8afcd4bb9f33","resolution":{"observed_at":"2026-08-12T20:56:15.595781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:16.542673Z","title":"DeepCPU : Serving RNN-based deep learning models 10x faster","venue":null,"work_id":"9c53c961-323d-4eca-85c9-1a5e3c21d849","year":2018},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.601544Z"},"links":{"citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:c3902da895aa0eea312192f7876ccdf0def5179d7e7c42041d8ed76ca9be8279","observation_id":"9a66df72-f32a-41b1-ba77-4ab3357bfea5","resolution":{"observed_at":"2026-08-12T20:56:16.547933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:16.525879Z","title":"H., Haj-Ali, A., Wang, Y., Yang, J., Zhuo, D., Sen, K., Gonzalez, J","venue":null,"work_id":"dbee54d7-9334-4eb4-ade6-de4182a6d50d","year":2020},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.605965Z"},"links":{"citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:2135c22579c783ae08c80d1941c70ffa64f17f0f0b8dde1032a4771f4362d088","observation_id":"9656f4ed-f265-46c7-9bdf-6434388e5888","resolution":{"observed_at":"2026-08-12T20:56:16.531220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06542","last_updated":"2024-05-01T16:24:53Z","snapshot_observed_at":"2026-08-13T00:17:32.239596Z","submitted_at":"2024-05-01T16:24:53Z","title":"vMCU: Coordinated Memory Management and Kernel Optimization for DNN Inference on MCUs","version":1},"cited_work":{"arxiv_id":"2406.06542","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.06542","snapshot_observed_at":"2026-08-12T20:56:15.722612Z","title":"vMCU: Coordinated Memory Management and Kernel Optimization for DNN Inference on MCUs","venue":"cs.AR","work_id":"09b0616b-1aba-42c6-9086-360aac5eb47a","year":2024},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.610777Z"},"links":{"cited_paper":"/paper/2406.06542","citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:407e21b8f1d6c591e5544beea45c71d881d5e429bc3d0f537e160a1f8c1574e0","observation_id":"0f583c32-1c31-45a0-8511-a2fd3c574681","resolution":{"observed_at":"2026-08-12T20:56:15.730113Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1611.01578","last_updated":"2017-02-15T05:28:05Z","snapshot_observed_at":"2026-08-14T21:31:52.294004Z","submitted_at":"2016-11-05T00:41:37Z","title":"Neural Architecture Search with Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.01578","snapshot_observed_at":"2026-08-12T20:56:15.615628Z","title":"and Le, Q","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.615628Z"},"links":{"cited_paper":"/paper/1611.01578","citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:c2e93e0e566253cc0d5092c4397641af86a8480b48bcdd8f83601b808666cb74","observation_id":"1ee2c716-5ce3-4f87-8c01-a730e8241a36","resolution":{"observed_at":"2026-08-12T20:56:15.615628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:15.620948Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-12T20:56:15.620948Z"},"links":{"citing_paper":"/paper/2411.09242"},"observation_digest":"sha256:d1b7b4d44a9d688d27e80f719213e804a74c334949f855b5a710fc69db0508d2","observation_id":"e4ac0616-10e2-4c9c-9291-206640762832","resolution":{"observed_at":"2026-08-12T20:56:15.620948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2411.09242","last_updated":"2024-11-14T07:16:23Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-13T13:21:23.748540Z","submitted_at":"2024-11-14T07:16:23Z","title":"FluidML: Fast and Memory Efficient Inference Optimization"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":35,"verified_exact":3,"verified_fuzzy":13},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 0 inbound Pith citation observations for arXiv:2411.09242."}