{"as_of":"2026-08-19T21:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:05c5e0398269451e38d28093349178d5907b47df5cec570bb824fd3058aaa9ff","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:42:08.287079Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.14513/citation-record","integrity":"/paper/2505.14513/integrity","json":"/paper/2505.14513/citation-record.json","paper":"/paper/2505.14513"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2209.15571","last_updated":"2023-03-09T15:18:40Z","snapshot_observed_at":"2026-08-14T22:23:53.150627Z","submitted_at":"2022-09-30T16:30:31Z","title":"Building Normalizing Flows with Stochastic Interpolants","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15571","snapshot_observed_at":"2026-08-07T15:42:04.744063Z","title":"Building normalizing flows with stochastic interpolants.arXiv preprint arXiv:2209.15571, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14513","last_updated":"2025-05-20T15:41:05Z","snapshot_observed_at":"2026-08-17T04:11:57.715200Z","submitted_at":"2025-05-20T15:41:05Z","title":"Latent Flow Transformer","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:04.744063Z"},"links":{"cited_paper":"/paper/2209.15571","citing_paper":"/paper/2505.14513"},"observation_digest":"sha256:ea93438175a7287a8d96cab1d5078e674c45ec61fdba89d19a29d60ad68cff1c","observation_id":"29f9fc06-50c8-4218-9c6e-088e8cf98219","resolution":{"observed_at":"2026-08-07T15:42:04.744063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:04.838254Z","title":"Neural ordinary differential equations.Advances in neural information processing systems, 31, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.14513","last_updated":"2025-05-20T15:41:05Z","snapshot_observed_at":"2026-08-17T04:11:57.715200Z","submitted_at":"2025-05-20T15:41:05Z","title":"Latent Flow Transformer","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:04.838254Z"},"links":{"citing_paper":"/paper/2505.14513"},"observation_digest":"sha256:ad36c877cc35af9e49ea379c1e3474da4edf69dd4566ca6297a8729679d31f8b","observation_id":"7fb1396e-e21b-40f7-a44d-1e5910f36a2a","resolution":{"observed_at":"2026-08-07T15:42:04.838254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:04.929738Z","title":"Contiformer: Continuous-time transformer for irregular time series modeling.Advances in Neural Information Processing Systems, 36:47143–47175, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14513","last_updated":"2025-05-20T15:41:05Z","snapshot_observed_at":"2026-08-17T04:11:57.715200Z","submitted_at":"2025-05-20T15:41:05Z","title":"Latent Flow Transformer","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:04.929738Z"},"links":{"citing_paper":"/paper/2505.14513"},"observation_digest":"sha256:34cc2ebe8c216631aa639d0ddd6750c9019e875196aa2aaf00a6fd5ea4157fe3","observation_id":"3a81e18d-4730-4fc7-afc6-25d8fc90336d","resolution":{"observed_at":"2026-08-07T15:42:04.929738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:12.732185Z","title":"Image generation with shortest path diffusion, 2023","venue":null,"work_id":"e69529ea-c887-4acb-aa90-61869e9328ed","year":2023},"citing_paper":{"arxiv_id":"2505.14513","last_updated":"2025-05-20T15:41:05Z","snapshot_observed_at":"2026-08-17T04:11:57.715200Z","submitted_at":"2025-05-20T15:41:05Z","title":"Latent Flow Transformer","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:05.036565Z"},"links":{"citing_paper":"/paper/2505.14513"},"observation_digest":"sha256:282c668793a8cefe5200c8253e765cb4cd40cccc0bba1af4677bdf3891305554","observation_id":"8398c942-6257-498f-b8fd-51d7c8346a4c","resolution":{"observed_at":"2026-08-07T15:42:12.813836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:12.576754Z","title":"Flowing through layers: A continuous dynamical systems perspective on transformers, 2025","venue":null,"work_id":"f45165c1-218a-4a17-9d59-2035b8223684","year":2025},"citing_paper":{"arxiv_id":"2505.14513","last_updated":"2025-05-20T15:41:05Z","snapshot_observed_at":"2026-08-17T04:11:57.715200Z","submitted_at":"2025-05-20T15:41:05Z","title":"Latent Flow Transformer","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:05.142082Z"},"links":{"citing_paper":"/paper/2505.14513"},"observation_digest":"sha256:8ab77a15ef3855d6dd5fa3bc6c6ceb45832985cca9ebbe440db7613f57f80da2","observation_id":"9ae75e30-f9c2-4af6-acda-90a19863c76b","resolution":{"observed_at":"2026-08-07T15:42:12.665818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12557","last_updated":"2025-06-23T14:26:35Z","snapshot_observed_at":"2026-08-17T08:09:05.115467Z","submitted_at":"2024-10-16T13:34:40Z","title":"One Step Diffusion via Shortcut Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.12557","snapshot_observed_at":"2026-08-07T15:42:05.234248Z","title":"One Step Diffusion via Shortcut Models, October 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14513","last_updated":"2025-05-20T15:41:05Z","snapshot_observed_at":"2026-08-17T04:11:57.715200Z","submitted_at":"2025-05-20T15:41:05Z","title":"Latent Flow Transformer","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:05.234248Z"},"links":{"cited_paper":"/paper/2410.12557","citing_paper":"/paper/2505.14513"},"observation_digest":"sha256:cc9c2f02a1351ec014088adbfe1eafc40afdbd2a6771acbb01271725f978a47e","observation_id":"ba8039ad-906c-47eb-bcef-b3a6a29cadc0","resolution":{"observed_at":"2026-08-07T15:42:05.234248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05171","last_updated":"2025-02-17T17:14:04Z","snapshot_observed_at":"2026-08-15T00:53:48.099058Z","submitted_at":"2025-02-07T18:55:02Z","title":"Scaling up Test-Time Compute with Latent Reasoning: A Recurrent Depth Approach","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05171","snapshot_observed_at":"2026-08-07T15:42:05.308833Z","title":"Scaling up test-time compute with latent reasoning: A recurrent depth approach.arXiv preprint arXiv:2502.05171, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14513","last_updated":"2025-05-20T15:41:05Z","snapshot_observed_at":"2026-08-17T04:11:57.715200Z","submitted_at":"2025-05-20T15:41:05Z","title":"Latent Flow Transformer","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:05.308833Z"},"links":{"cited_paper":"/paper/2502.05171","citing_paper":"/paper/2505.14513"},"observation_digest":"sha256:67c7ce487e1508590a6ae6053d033383d5e62d888fd9886d4bc4ef6050eebbbb","observation_id":"0ca0ce97-9a43-4cc3-a917-658d09b180a5","resolution":{"observed_at":"2026-08-07T15:42:05.308833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:12.237052Z","title":"Compressing bert: Studying the effects of weight pruning on transfer learning","venue":null,"work_id":"335f5b16-b86f-45de-99f8-cdbf607425da","year":2020},"citing_paper":{"arxiv_id":"2505.14513","last_updated":"2025-05-20T15:41:05Z","snapshot_observed_at":"2026-08-17T04:11:57.715200Z","submitted_at":"2025-05-20T15:41:05Z","title":"Latent Flow Transformer","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:05.411946Z"},"links":{"citing_paper":"/paper/2505.14513"},"observation_digest":"sha256:fbb167c65ef15e6d06f3b13f18883c4ee9a44b196da8b8fde7fb73a84e81a7fa","observation_id":"ca1db6e2-a0dd-4823-862c-f75045992e69","resolution":{"observed_at":"2026-08-07T15:42:12.398340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:05.488553Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14513","last_updated":"2025-05-20T15:41:05Z","snapshot_observed_at":"2026-08-17T04:11:57.715200Z","submitted_at":"2025-05-20T15:41:05Z","title":"Latent Flow Transformer","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:05.488553Z"},"links":{"citing_paper":"/paper/2505.14513"},"observation_digest":"sha256:0345b58a1e6f1b93db21d6a073b912bc110df9b993654eea514a5b315e8d38f5","observation_id":"9f634ecf-ee85-48db-82a5-6785cf4ba4c8","resolution":{"observed_at":"2026-08-07T15:42:05.488553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:11.942305Z","title":"Calmflow: V olterra flow matching using causal language models, 2024","venue":null,"work_id":"2082ae46-7d07-4635-937d-1533fae039ad","year":2024},"citing_paper":{"arxiv_id":"2505.14513","last_updated":"2025-05-20T15:41:05Z","snapshot_observed_at":"2026-08-17T04:11:57.715200Z","submitted_at":"2025-05-20T15:41:05Z","title":"Latent Flow Transformer","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:05.567737Z"},"links":{"citing_paper":"/paper/2505.14513"},"observation_digest":"sha256:39782c8cc72f7a2e38208be9cb305fbef506a1e9a418a8afc9004eee9b32d65e","observation_id":"ef6883ec-e831-4e1d-a6f8-800d51b51c4c","resolution":{"observed_at":"2026-08-07T15:42:12.111392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:11.531281Z","title":"Flow matching for conditional text generation in a few sampling steps","venue":null,"work_id":"ef6ebb5b-d74d-4467-9655-32e09fdb4edc","year":2024},"citing_paper":{"arxiv_id":"2505.14513","last_updated":"2025-05-20T15:41:05Z","snapshot_observed_at":"2026-08-17T04:11:57.715200Z","submitted_at":"2025-05-20T15:41:05Z","title":"Latent Flow Transformer","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:05.641993Z"},"links":{"citing_paper":"/paper/2505.14513"},"observation_digest":"sha256:5f0c50a9bfa29d8944f1532a5dcafd67e1bd241c087cfc17feb9a8b745856ac1","observation_id":"8e243714-6c18-468c-be0c-bbf9d4f1e432","resolution":{"observed_at":"2026-08-07T15:42:11.698654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:11.235222Z","title":"Editing models with task arithmetic","venue":null,"work_id":"144ba82e-1206-4e4a-9b52-9c13de652377","year":2023},"citing_paper":{"arxiv_id":"2505.14513","last_updated":"2025-05-20T15:41:05Z","snapshot_observed_at":"2026-08-17T04:11:57.715200Z","submitted_at":"2025-05-20T15:41:05Z","title":"Latent Flow Transformer","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:05.727176Z"},"links":{"citing_paper":"/paper/2505.14513"},"observation_digest":"sha256:1f7c0106b7d7e28f6e526913748bed9555b43ce3da8f75a927829d7f02aaff3e","observation_id":"4a69c331-c88c-4edb-bb77-1f8f44237d80","resolution":{"observed_at":"2026-08-07T15:42:11.332681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:11.061349Z","title":"Tinybert: Distilling bert for natural language understanding","venue":null,"work_id":"9b5bf3f9-7187-4faf-950b-819677a5a41e","year":2019},"citing_paper":{"arxiv_id":"2505.14513","last_updated":"2025-05-20T15:41:05Z","snapshot_observed_at":"2026-08-17T04:11:57.715200Z","submitted_at":"2025-05-20T15:41:05Z","title":"Latent Flow Transformer","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:05.803732Z"},"links":{"citing_paper":"/paper/2505.14513"},"observation_digest":"sha256:526fa1f1976c36d3fce46df0b6603c066378f95286296b057d96c4f3e11321b5","observation_id":"b6be37b5-3e92-49fa-a5e9-af5eb0d74a78","resolution":{"observed_at":"2026-08-07T15:42:11.150714Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.02435","last_updated":"2022-02-04T23:32:29Z","snapshot_observed_at":"2026-08-18T09:10:57.429276Z","submitted_at":"2022-02-04T23:32:29Z","title":"On Neural Differential Equations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.02435","snapshot_observed_at":"2026-08-07T15:42:05.879835Z","title":"On neural differential equations.arXiv preprint arXiv:2202.02435, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14513","last_updated":"2025-05-20T15:41:05Z","snapshot_observed_at":"2026-08-17T04:11:57.715200Z","submitted_at":"2025-05-20T15:41:05Z","title":"Latent Flow Transformer","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:05.879835Z"},"links":{"cited_paper":"/paper/2202.02435","citing_paper":"/paper/2505.14513"},"observation_digest":"sha256:c8ba1ccd91b3bff9fd0471fc4755a2e68033cffd91e8bcdc70267164cb0a622a","observation_id":"10c434e8-8223-4ef8-ba38-21618d1f1d93","resolution":{"observed_at":"2026-08-07T15:42:05.879835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.15166","last_updated":"2024-04-04T01:53:38Z","snapshot_observed_at":"2026-08-17T05:36:57.620321Z","submitted_at":"2023-12-23T05:11:37Z","title":"SOLAR 10.7B: Scaling Large Language Models with Simple yet Effective Depth Up-Scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.15166","snapshot_observed_at":"2026-08-07T15:42:05.936200Z","title":"Solar 10.7 b: Scaling large language models with simple yet effective depth up-scaling.arXiv preprint arXiv:2312.15166, 2023","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14513","last_updated":"2025-05-20T15:41:05Z","snapshot_observed_at":"2026-08-17T04:11:57.715200Z","submitted_at":"2025-05-20T15:41:05Z","title":"Latent Flow Transformer","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:05.936200Z"},"links":{"cited_paper":"/paper/2312.15166","citing_paper":"/paper/2505.14513"},"observation_digest":"sha256:bd0f49e8701290b8fbdc08c986f9a17ba4199724ab329839a6a0a5a045f50b03","observation_id":"db79b3e1-1de4-4d1b-8839-711344341c75","resolution":{"observed_at":"2026-08-07T15:42:05.936200Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.22918","last_updated":"2024-10-30T11:18:27Z","snapshot_observed_at":"2026-08-16T13:04:35.658401Z","submitted_at":"2024-10-30T11:18:27Z","title":"Simulation-Free Training of Neural ODEs on Paired Data","version":1},"cited_work":{"arxiv_id":"2410.22918","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.22918","snapshot_observed_at":"2026-08-07T15:42:08.957320Z","title":"Simulation-Free Training of Neural ODEs on Paired Data","venue":"cs.LG","work_id":"f7c4dca7-af58-4011-a81d-5c878c92711f","year":2024},"citing_paper":{"arxiv_id":"2505.14513","last_updated":"2025-05-20T15:41:05Z","snapshot_observed_at":"2026-08-17T04:11:57.715200Z","submitted_at":"2025-05-20T15:41:05Z","title":"Latent Flow Transformer","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:06.008970Z"},"links":{"cited_paper":"/paper/2410.22918","citing_paper":"/paper/2505.14513"},"observation_digest":"sha256:c1f173d6cc47ca5794df6efe9e0e218fed6b9527d09d4cf58532bee529a452cd","observation_id":"b58f5ddc-a280-46eb-9627-3ffe6447f721","resolution":{"observed_at":"2026-08-07T15:42:09.016857Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:10.918653Z","title":"Simulation-free training of neural odes on paired data.Advances in Neural Information Processing Systems, 37:60212–60236, 2024","venue":null,"work_id":"2af9c0c8-4a6e-4018-86c0-7314e42863d0","year":2024},"citing_paper":{"arxiv_id":"2505.14513","last_updated":"2025-05-20T15:41:05Z","snapshot_observed_at":"2026-08-17T04:11:57.715200Z","submitted_at":"2025-05-20T15:41:05Z","title":"Latent Flow Transformer","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:06.078124Z"},"links":{"citing_paper":"/paper/2505.14513"},"observation_digest":"sha256:8d8c747de30f46b2dc72863b2f30a8188afacabe1ff11607d1d60eee760730d0","observation_id":"9a7bf753-1d38-4a4a-a897-6b5b928dba54","resolution":{"observed_at":"2026-08-07T15:42:10.969995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.11942","last_updated":"2020-02-09T03:00:18Z","snapshot_observed_at":"2026-08-18T01:27:11.590348Z","submitted_at":"2019-09-26T07:06:13Z","title":"ALBERT: A Lite BERT for Self-supervised Learning of Language Representations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.11942","snapshot_observed_at":"2026-08-07T15:42:06.144909Z","title":"ALBERT: A Lite BERT for Self-supervised Learning of Language Representations, February 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.14513","last_updated":"2025-05-20T15:41:05Z","snapshot_observed_at":"2026-08-17T04:11:57.715200Z","submitted_at":"2025-05-20T15:41:05Z","title":"Latent Flow Transformer","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:06.144909Z"},"links":{"cited_paper":"/paper/1909.11942","citing_paper":"/paper/2505.14513"},"observation_digest":"sha256:777bce71eb80bc58f42f16b3c97a97042140e4e4964552dddf989c078879e02c","observation_id":"62134852-3dc5-487f-a893-e431302f7695","resolution":{"observed_at":"2026-08-07T15:42:06.144909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:10.712940Z","title":"ODE transformer: An ordinary differential equation-inspired model for sequence generation","venue":null,"work_id":"0078da3a-b64c-47d7-a062-22fe7c1cf6f7","year":2022},"citing_paper":{"arxiv_id":"2505.14513","last_updated":"2025-05-20T15:41:05Z","snapshot_observed_at":"2026-08-17T04:11:57.715200Z","submitted_at":"2025-05-20T15:41:05Z","title":"Latent Flow Transformer","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:06.219823Z"},"links":{"citing_paper":"/paper/2505.14513"},"observation_digest":"sha256:8e139171133409ab337e4562089896b3ee5fb84d8b79b8da320f467948534e22","observation_id":"83f67c23-0f0a-4e82-8f34-5f1524bfb7ca","resolution":{"observed_at":"2026-08-07T15:42:10.797127Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.08891","last_updated":"2024-01-23T03:08:28Z","snapshot_observed_at":"2026-08-18T03:37:34.976613Z","submitted_at":"2023-05-15T12:21:08Z","title":"Common Diffusion Noise Schedules and Sample Steps are Flawed","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.08891","snapshot_observed_at":"2026-08-07T15:42:06.330010Z","title":"Diffusion via conditional transport.arXiv preprint arXiv:2305.08891, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14513","last_updated":"2025-05-20T15:41:05Z","snapshot_observed_at":"2026-08-17T04:11:57.715200Z","submitted_at":"2025-05-20T15:41:05Z","title":"Latent Flow Transformer","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:06.330010Z"},"links":{"cited_paper":"/paper/2305.08891","citing_paper":"/paper/2505.14513"},"observation_digest":"sha256:c897a447db275cac605b086badc49c7cb28aa0dd51ef2760c4261e02d4c20a77","observation_id":"c3fa0111-1d77-4436-875d-47aa54545b6d","resolution":{"observed_at":"2026-08-07T15:42:06.330010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:10.533128Z","title":null,"venue":null,"work_id":"ef6dda0c-606a-427e-b7af-838b16862524","year":2020},"citing_paper":{"arxiv_id":"2505.14513","last_updated":"2025-05-20T15:41:05Z","snapshot_observed_at":"2026-08-17T04:11:57.715200Z","submitted_at":"2025-05-20T15:41:05Z","title":"Latent Flow Transformer","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:06.410738Z"},"links":{"citing_paper":"/paper/2505.14513"},"observation_digest":"sha256:333cb32e4ef9bfa830bcb7542bf5cfe9d73ba9b7b5294b1835a3d01cb809f791","observation_id":"08dce9dc-4532-44ad-ba65-a46bad6cccbc","resolution":{"observed_at":"2026-08-07T15:42:10.632986Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:06.469304Z","title":"Text generation with diffusion language models: A pre-training approach with continuous paragraph denoise","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14513","last_updated":"2025-05-20T15:41:05Z","snapshot_observed_at":"2026-08-17T04:11:57.715200Z","submitted_at":"2025-05-20T15:41:05Z","title":"Latent Flow Transformer","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:06.469304Z"},"links":{"citing_paper":"/paper/2505.14513"},"observation_digest":"sha256:dc234fed2912c7e174eb887dadbe7eb88f12b09cd6cfbc0b67855cec4226fbbc","observation_id":"b3d10c7a-d506-4243-bf30-e23a413661ef","resolution":{"observed_at":"2026-08-07T15:42:06.469304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:06.553638Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14513","last_updated":"2025-05-20T15:41:05Z","snapshot_observed_at":"2026-08-17T04:11:57.715200Z","submitted_at":"2025-05-20T15:41:05Z","title":"Latent Flow Transformer","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:06.553638Z"},"links":{"citing_paper":"/paper/2505.14513"},"observation_digest":"sha256:19f6d780f06344574235a88cf5910b2e75c6a7c97476eef67d24d6d24fad0cd2","observation_id":"95d662c6-bd6a-42dc-98ff-4344932639c2","resolution":{"observed_at":"2026-08-07T15:42:06.553638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:10.328282Z","title":"Flow matching for generative modeling","venue":null,"work_id":"4dfcca6d-2510-480b-b47f-255387bc2ab2","year":2022},"citing_paper":{"arxiv_id":"2505.14513","last_updated":"2025-05-20T15:41:05Z","snapshot_observed_at":"2026-08-17T04:11:57.715200Z","submitted_at":"2025-05-20T15:41:05Z","title":"Latent Flow Transformer","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:06.657063Z"},"links":{"citing_paper":"/paper/2505.14513"},"observation_digest":"sha256:cf8483b83bf99cdd61228d29134fb5369d188262028f3a125145d34fd38bdf24","observation_id":"1b1962a6-0c1c-4da5-a83a-5a69a7e60dd7","resolution":{"observed_at":"2026-08-07T15:42:10.396275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14687","last_updated":"2024-05-20T04:23:45Z","snapshot_observed_at":"2026-08-14T03:13:28.801183Z","submitted_at":"2022-09-29T11:12:27Z","title":"Diffusion Posterior Sampling for General Noisy Inverse Problems","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14687","snapshot_observed_at":"2026-08-07T15:42:06.734199Z","title":"Rectified flow: Learning deep generative models using optimal transport.arXiv preprint arXiv:2209.14687, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14513","last_updated":"2025-05-20T15:41:05Z","snapshot_observed_at":"2026-08-17T04:11:57.715200Z","submitted_at":"2025-05-20T15:41:05Z","title":"Latent Flow Transformer","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:06.734199Z"},"links":{"cited_paper":"/paper/2209.14687","citing_paper":"/paper/2505.14513"},"observation_digest":"sha256:395247d1652d934ab88b9409829a106a03c91bf7511e9fcd893374e8dad7372d","observation_id":"cce4b321-0dee-4224-b5c0-f8ddd8c1804b","resolution":{"observed_at":"2026-08-07T15:42:06.734199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15558","last_updated":"2024-11-23T13:31:16Z","snapshot_observed_at":"2026-08-13T09:12:29.363596Z","submitted_at":"2024-11-23T13:31:16Z","title":"Reassessing Layer Pruning in LLMs: New Insights and Methods","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15558","snapshot_observed_at":"2026-08-07T15:42:06.926464Z","title":"Reassessing layer pruning in llms: New insights and methods.arXiv preprint arXiv:2411.15558, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14513","last_updated":"2025-05-20T15:41:05Z","snapshot_observed_at":"2026-08-17T04:11:57.715200Z","submitted_at":"2025-05-20T15:41:05Z","title":"Latent Flow Transformer","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:06.926464Z"},"links":{"cited_paper":"/paper/2411.15558","citing_paper":"/paper/2505.14513"},"observation_digest":"sha256:79cb7525ccab12b221ab45b546799a28652543124ccdfaaa095b26e9189df349","observation_id":"7d230d89-0053-4eaa-bb79-f3a7f865cef3","resolution":{"observed_at":"2026-08-07T15:42:06.926464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.14841","last_updated":"2022-06-29T18:11:01Z","snapshot_observed_at":"2026-08-16T16:49:26.755165Z","submitted_at":"2022-06-29T18:11:01Z","title":"Causality for Inherently Explainable Transformers: CAT-XPLAIN","version":1},"cited_work":{"arxiv_id":"2206.14841","doi":null,"metadata_source":"pith","pith_arxiv_id":"2206.14841","snapshot_observed_at":"2026-08-07T15:42:08.726935Z","title":"Causality for Inherently Explainable Transformers: CAT-XPLAIN","venue":"cs.CV","work_id":"a1c7c8a2-1a89-4d54-9ab6-0c297199e045","year":2022},"citing_paper":{"arxiv_id":"2505.14513","last_updated":"2025-05-20T15:41:05Z","snapshot_observed_at":"2026-08-17T04:11:57.715200Z","submitted_at":"2025-05-20T15:41:05Z","title":"Latent Flow Transformer","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:07.007185Z"},"links":{"cited_paper":"/paper/2206.14841","citing_paper":"/paper/2505.14513"},"observation_digest":"sha256:a8b419f468a88eb107ca3ef0f9789d994c4208ff0540212562c6a6762b4ef0ea","observation_id":"16041421-cc99-44e4-883e-5e55a1e22246","resolution":{"observed_at":"2026-08-07T15:42:08.840867Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:07.089810Z","title":"Normalizing flows for probabilistic modeling and inference.Journal of Machine Learning Research, 22(57):1–64, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14513","last_updated":"2025-05-20T15:41:05Z","snapshot_observed_at":"2026-08-17T04:11:57.715200Z","submitted_at":"2025-05-20T15:41:05Z","title":"Latent Flow Transformer","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:07.089810Z"},"links":{"citing_paper":"/paper/2505.14513"},"observation_digest":"sha256:a3831d3bac4691cb4a204478b4e18eb4bdffb63075e91622b1033952a1909b1f","observation_id":"fd65abe9-21e5-43fe-a2dd-4b00f5a7445e","resolution":{"observed_at":"2026-08-07T15:42:07.089810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:10.144727Z","title":null,"venue":null,"work_id":"32b07a18-d761-43f6-951a-d84f82ddadb3","year":2024},"citing_paper":{"arxiv_id":"2505.14513","last_updated":"2025-05-20T15:41:05Z","snapshot_observed_at":"2026-08-17T04:11:57.715200Z","submitted_at":"2025-05-20T15:41:05Z","title":"Latent Flow Transformer","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:07.166835Z"},"links":{"citing_paper":"/paper/2505.14513"},"observation_digest":"sha256:d0b38ad582501c6577b519b25977ac96f9004ec203f8ff25df027e4379cd75a6","observation_id":"e7025f3b-fadc-4c21-a77b-8a1893e81ef8","resolution":{"observed_at":"2026-08-07T15:42:10.272517Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:07.250284Z","title":"Scalable diffusion models with transformers, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14513","last_updated":"2025-05-20T15:41:05Z","snapshot_observed_at":"2026-08-17T04:11:57.715200Z","submitted_at":"2025-05-20T15:41:05Z","title":"Latent Flow Transformer","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:07.250284Z"},"links":{"citing_paper":"/paper/2505.14513"},"observation_digest":"sha256:d58bb9ff713e7e23a99ba981ea52d5964a3f3a556a8c12e59e8705cce7e1ad05","observation_id":"54037fc0-4f24-436f-9105-78c42f5dccc3","resolution":{"observed_at":"2026-08-07T15:42:07.250284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:09.879536Z","title":"Computational optimal transport: With applications to data science.F oundations and Trends® in Machine Learning, 11(5-6):355–607, 2019","venue":null,"work_id":"83d53747-b1a8-4e77-a042-2b3f11cdb7f0","year":2019},"citing_paper":{"arxiv_id":"2505.14513","last_updated":"2025-05-20T15:41:05Z","snapshot_observed_at":"2026-08-17T04:11:57.715200Z","submitted_at":"2025-05-20T15:41:05Z","title":"Latent Flow Transformer","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:07.324475Z"},"links":{"citing_paper":"/paper/2505.14513"},"observation_digest":"sha256:065504e6ca10baa6541a9e80a52cf0e2c7c5e720757afd07a714a301f2b86014","observation_id":"cdee4990-e641-41b0-b9d3-96428482dc38","resolution":{"observed_at":"2026-08-07T15:42:09.989898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:09.633497Z","title":"On the effect of dropping layers of pre-trained transformer models.Computer Speech & Language, 77:101429, January 2023","venue":null,"work_id":"80a68455-7664-4555-98ce-8b79931c8a7c","year":2023},"citing_paper":{"arxiv_id":"2505.14513","last_updated":"2025-05-20T15:41:05Z","snapshot_observed_at":"2026-08-17T04:11:57.715200Z","submitted_at":"2025-05-20T15:41:05Z","title":"Latent Flow Transformer","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:07.432156Z"},"links":{"citing_paper":"/paper/2505.14513"},"observation_digest":"sha256:96dcca186f384caf165eb8fd3a262ee6c849d259e78c762ce827741ec19b9fbb","observation_id":"3a5fd608-f411-4d40-ab06-ff8fe98e5f0c","resolution":{"observed_at":"2026-08-07T15:42:09.748595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.01108","last_updated":"2020-03-01T02:57:50Z","snapshot_observed_at":"2026-08-07T19:07:36.327251Z","submitted_at":"2019-10-02T17:56:28Z","title":"DistilBERT, a distilled version of BERT: smaller, faster, cheaper and lighter","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.01108","snapshot_observed_at":"2026-08-07T15:42:07.539699Z","title":"Distilbert, a distilled version of bert: smaller, faster, cheaper and lighter","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2505.14513","last_updated":"2025-05-20T15:41:05Z","snapshot_observed_at":"2026-08-17T04:11:57.715200Z","submitted_at":"2025-05-20T15:41:05Z","title":"Latent Flow Transformer","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:07.539699Z"},"links":{"cited_paper":"/paper/1910.01108","citing_paper":"/paper/2505.14513"},"observation_digest":"sha256:d9e6bb2faf96ed96a485dd00f6760a5548ce0fdc36d64c32f4000162a573e0e7","observation_id":"a500fef1-1318-4cd9-acca-fb53960b9c0f","resolution":{"observed_at":"2026-08-07T15:42:07.539699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:07.606463Z","title":"Consistency models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14513","last_updated":"2025-05-20T15:41:05Z","snapshot_observed_at":"2026-08-17T04:11:57.715200Z","submitted_at":"2025-05-20T15:41:05Z","title":"Latent Flow Transformer","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:07.606463Z"},"links":{"citing_paper":"/paper/2505.14513"},"observation_digest":"sha256:edefbb42fed96dbc93ae28c0052baeed9d06d347b0f485fdbbb4a3188301195b","observation_id":"a3c715d5-b616-4389-8736-9c8dc96797f3","resolution":{"observed_at":"2026-08-07T15:42:07.606463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:09.434197Z","title":"Patient knowledge distillation for bert model compression, 2019","venue":null,"work_id":"25b3d493-c185-4dc9-bb35-ba4fe4e15df4","year":2019},"citing_paper":{"arxiv_id":"2505.14513","last_updated":"2025-05-20T15:41:05Z","snapshot_observed_at":"2026-08-17T04:11:57.715200Z","submitted_at":"2025-05-20T15:41:05Z","title":"Latent Flow Transformer","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:07.670651Z"},"links":{"citing_paper":"/paper/2505.14513"},"observation_digest":"sha256:9cd7715de565271e0463ad2a22e63936e03a72e67ad9653ba2a0155b0cda549d","observation_id":"5898b8e9-0c4c-44bb-bf8b-b40b59b5db62","resolution":{"observed_at":"2026-08-07T15:42:09.492700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:07.770954Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.14513","last_updated":"2025-05-20T15:41:05Z","snapshot_observed_at":"2026-08-17T04:11:57.715200Z","submitted_at":"2025-05-20T15:41:05Z","title":"Latent Flow Transformer","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:07.770954Z"},"links":{"citing_paper":"/paper/2505.14513"},"observation_digest":"sha256:0bb7ab6ea6df84714ca91f07f420c5c0e20c90310f2c18c464bf1161f7f71c09","observation_id":"8218468e-2b8b-4eba-9fc2-409719781939","resolution":{"observed_at":"2026-08-07T15:42:07.770954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13640","last_updated":"2025-03-13T16:16:12Z","snapshot_observed_at":"2026-08-18T07:56:42.704091Z","submitted_at":"2024-10-17T15:09:24Z","title":"Latent Space Chain-of-Embedding Enables Output-free LLM Self-Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13640","snapshot_observed_at":"2026-08-07T15:42:07.858803Z","title":"Latent space chain-of- embedding enables output-free llm self-evaluation.arXiv preprint arXiv:2410.13640, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14513","last_updated":"2025-05-20T15:41:05Z","snapshot_observed_at":"2026-08-17T04:11:57.715200Z","submitted_at":"2025-05-20T15:41:05Z","title":"Latent Flow Transformer","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:07.858803Z"},"links":{"cited_paper":"/paper/2410.13640","citing_paper":"/paper/2505.14513"},"observation_digest":"sha256:3f93181281d5bce9ef5d1f6248acfc13e3e3a62928485d04198fb91b91b3a849","observation_id":"78333acf-1dde-4afa-a472-d21057a52eaa","resolution":{"observed_at":"2026-08-07T15:42:07.858803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:09.276569Z","title":"Ar-diffusion: auto-regressive diffusion model for text generation","venue":null,"work_id":"01373ffb-bf06-43d8-babe-402a581fed8c","year":2023},"citing_paper":{"arxiv_id":"2505.14513","last_updated":"2025-05-20T15:41:05Z","snapshot_observed_at":"2026-08-17T04:11:57.715200Z","submitted_at":"2025-05-20T15:41:05Z","title":"Latent Flow Transformer","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:07.995249Z"},"links":{"citing_paper":"/paper/2505.14513"},"observation_digest":"sha256:df630ed149439b0186d71b309e507ccf7ea2bc3cea1a4fda79d912042ddc40ab","observation_id":"aebb5e47-b2db-402d-9155-4a52a3707910","resolution":{"observed_at":"2026-08-07T15:42:09.349024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:09.165495Z","title":"A survey on knowledge distillation of large language models, 2024","venue":null,"work_id":"e42092f2-d0b3-4126-8059-32a25e126dd6","year":2024},"citing_paper":{"arxiv_id":"2505.14513","last_updated":"2025-05-20T15:41:05Z","snapshot_observed_at":"2026-08-17T04:11:57.715200Z","submitted_at":"2025-05-20T15:41:05Z","title":"Latent Flow Transformer","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:08.135324Z"},"links":{"citing_paper":"/paper/2505.14513"},"observation_digest":"sha256:1de50af35acf5ae2e373eea6f2cddee4e1844721c3c6c40da75d91961099b2fe","observation_id":"945ede6c-e8a7-4960-be3a-433816919820","resolution":{"observed_at":"2026-08-07T15:42:09.210194Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.07436","last_updated":"2021-03-02T00:05:58Z","snapshot_observed_at":"2026-08-17T05:59:27.222604Z","submitted_at":"2021-02-15T10:14:44Z","title":"Approximation to Object Conditional Validity with Inductive Conformal Predictors","version":2},"cited_work":{"arxiv_id":"2102.07436","doi":null,"metadata_source":"pith","pith_arxiv_id":"2102.07436","snapshot_observed_at":"2026-08-07T15:42:08.443649Z","title":"Approximation to Object Conditional Validity with Inductive Conformal Predictors","venue":"cs.LG","work_id":"0b10f0e4-4ea8-4927-a4ce-aea7f2ba2365","year":2021},"citing_paper":{"arxiv_id":"2505.14513","last_updated":"2025-05-20T15:41:05Z","snapshot_observed_at":"2026-08-17T04:11:57.715200Z","submitted_at":"2025-05-20T15:41:05Z","title":"Latent Flow Transformer","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:08.287079Z"},"links":{"cited_paper":"/paper/2102.07436","citing_paper":"/paper/2505.14513"},"observation_digest":"sha256:bc9d70157009b62331d8f55fa5dd7069e6110688a2ceb420424636552314fdde","observation_id":"0bf099e8-ba4f-4410-b7ed-c3cbb50a66a5","resolution":{"observed_at":"2026-08-07T15:42:08.579727Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.14513","last_updated":"2025-05-20T15:41:05Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-17T04:11:57.715200Z","submitted_at":"2025-05-20T15:41:05Z","title":"Latent Flow Transformer"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":1,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":21,"verified_exact":1,"verified_fuzzy":15},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 0 inbound Pith citation observations for arXiv:2505.14513."}