{"as_of":"2026-08-08T12:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:403e722a09ae1baefca5e6cd6882155d9d378d6622da3161152b6af707471aad","coverage":[{"denominator":53,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":53,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:35:57.326726Z","state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.07572/citation-record","integrity":"/paper/2506.07572/integrity","json":"/paper/2506.07572/citation-record.json","paper":"/paper/2506.07572"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:58.574274Z","title":null,"venue":null,"work_id":"ff0adebe-6a4b-4974-a0bc-e8ee86e19592","year":2019},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:56.960283Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:6da66509de5f12cd192f49005ab986ead6bd4abeebec85b496edba09b0cefaa6","observation_id":"0b3ef035-a2a0-4a9a-ba76-5bd9af8c5264","resolution":{"observed_at":"2026-08-07T05:35:58.580868Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:58.550035Z","title":null,"venue":null,"work_id":"3c878251-c540-4f3e-b875-09309cbf46f0","year":2023},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:56.969435Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:ea70249c2a3a0489f1ba8b96758f25e43957433a1944cbbfcaaee23d454c87e4","observation_id":"b80dcea8-853a-4e6d-b407-fc75b7d3bd52","resolution":{"observed_at":"2026-08-07T05:35:58.556732Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:58.528863Z","title":null,"venue":null,"work_id":"110b127a-a201-4db2-8b1a-ee8bcd9b7b0f","year":2018},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:56.975377Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:cb724c4ba7b9c43f12931dc6a1b754f4e2a8795b745a43c223b329326ee7dacb","observation_id":"0cd3e3e5-62ef-4f2d-ab26-b5b34cc04185","resolution":{"observed_at":"2026-08-07T05:35:58.534401Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1611.01599","last_updated":"2016-12-16T16:09:34Z","snapshot_observed_at":"2026-07-06T05:17:29.499249Z","submitted_at":"2016-11-05T04:05:18Z","title":"LipNet: End-to-End Sentence-level Lipreading","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.01599","snapshot_observed_at":"2026-08-07T05:35:56.980880Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:56.980880Z"},"links":{"cited_paper":"/paper/1611.01599","citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:48af614fbba8ca63bad227322f58cc82592f02beaac0a2a4d19ba04dfd4b706f","observation_id":"c9bb44bd-82c2-4f27-96e4-046cb96642a6","resolution":{"observed_at":"2026-08-07T05:35:56.980880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:58.508290Z","title":null,"venue":null,"work_id":"6ac8be7b-2463-485b-b10e-b06a3a18dc7f","year":2020},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:56.988541Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:d83b80ffd5e1db11e9fc801ce41fcd14b27f68f3b9d867fd035f75a3ef9b8487","observation_id":"e7789c80-4848-4c27-acd6-9db5755cba9e","resolution":{"observed_at":"2026-08-07T05:35:58.514300Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:58.484268Z","title":null,"venue":null,"work_id":"853b29d9-5c8f-4cee-8b6c-5488cb7f4dfa","year":2023},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:56.996463Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:381e288a04532e2fd744fa46a7b4c341f0cb1e146ec66a4e04e4bf60b9dcc9d4","observation_id":"c85442e2-91dd-4ac4-a58c-c42e9b959f56","resolution":{"observed_at":"2026-08-07T05:35:58.489812Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:58.467496Z","title":null,"venue":null,"work_id":"232ea013-9b12-4236-a0fc-6b33f022d552","year":2024},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.003255Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:ea918ad163fbd22d54f16523e57d6849204f115cf6080dedd84c7f1dcf4e298b","observation_id":"abc88cec-3986-4956-9208-ace52b7ee11b","resolution":{"observed_at":"2026-08-07T05:35:58.472335Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:58.449860Z","title":null,"venue":null,"work_id":"4fe53e48-b808-4bd7-b2ef-ecaa22113995","year":2020},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.009711Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:9f543b2d8cd732a604e26dffa37e3ba2aa36a15eab56e9d19eddbdb427787f4e","observation_id":"9e397b37-f5f6-4500-b45f-b6f7a6e8d71e","resolution":{"observed_at":"2026-08-07T05:35:58.454996Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.014580Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.014580Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:9d59c0c10c983440e5833cd105543ab5c064e709f1c8706e3bba5dd526235257","observation_id":"b2da07c0-a828-4440-828f-77d2dc606f47","resolution":{"observed_at":"2026-08-07T05:35:57.014580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:58.410768Z","title":null,"venue":null,"work_id":"08c7bbfc-7fdb-43ad-8e26-53dd19e98164","year":2017},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.027180Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:b88d5ddcf3c7f3db5b456a7dad3ca725587b5cd2bfc5d01b6ddad4ccffc67e79","observation_id":"8e78830e-ef28-4e1b-9ee0-7fd7f6933fba","resolution":{"observed_at":"2026-08-07T05:35:58.416223Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:58.387383Z","title":null,"venue":null,"work_id":"580dee86-fb0f-4826-a148-c0249c44826e","year":2006},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.034570Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:586eb1dcff160a45bb558c1401f1e44208b3ceaa662de5240073c092272382bd","observation_id":"31d8d772-5183-481f-9067-37e786f5fb95","resolution":{"observed_at":"2026-08-07T05:35:58.394156Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:58.369654Z","title":null,"venue":null,"work_id":"202909b7-6460-4ee0-885f-d0d6d1e40d82","year":2021},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.041246Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:b1162e32aff48b1cf27c7f1bbf7466687e27f997e0f3929b61d0491b0c0669f3","observation_id":"65603e4e-06a2-4da2-a34a-0676af7a8efc","resolution":{"observed_at":"2026-08-07T05:35:58.375177Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.11097","last_updated":"2021-06-21T13:30:33Z","snapshot_observed_at":"2026-08-04T10:19:49.212509Z","submitted_at":"2021-06-21T13:30:33Z","title":"CLIP2Video: Mastering Video-Text Retrieval via Image CLIP","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.11097","snapshot_observed_at":"2026-08-07T05:35:57.052410Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.052410Z"},"links":{"cited_paper":"/paper/2106.11097","citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:93e53708640960abcfc5086607828543eda27cd6f2af869be09f0b455ec5cf99","observation_id":"ddea426d-f18b-44c0-99df-70fe5494a31e","resolution":{"observed_at":"2026-08-07T05:35:57.052410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.062052Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.062052Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:00066c7cdbc6db077e0d476544b487910e8698e49a5a43dd9771252e590d1111","observation_id":"7e9c7e05-9f8b-4055-99cd-18c7ef5f6d0f","resolution":{"observed_at":"2026-08-07T05:35:57.062052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:58.341428Z","title":null,"venue":null,"work_id":"a4fa16a9-d8f8-4763-b394-9420070bd6e3","year":2024},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.067105Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:4a08ce8e9f2c8937ce33eea4b3190dc50ea44cc6d6c9ad2ae67edbccb74064d2","observation_id":"fabbdd1c-2fb6-44f4-a3fc-330f544fee72","resolution":{"observed_at":"2026-08-07T05:35:58.346521Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:58.324041Z","title":null,"venue":null,"work_id":"b28879e4-0f2a-4391-8a36-c201f3af4868","year":2021},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.074813Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:f67a6e370c0ef4bffa12db98ccbe366ad93edbdde35966aba0234c2c902fc231","observation_id":"5b64ae1d-d4fa-425b-9fd6-67dc28535db9","resolution":{"observed_at":"2026-08-07T05:35:58.329440Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:58.302621Z","title":null,"venue":null,"work_id":"4eebfe26-22b7-445c-8e33-d20ab60080c1","year":2022},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.080027Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:b3f6d4aacc509f835d34794eb14c76bf67f05e1a901d44b779c8b8c46cf19f69","observation_id":"fa5bfc9e-ee28-4797-a65e-cce01337923a","resolution":{"observed_at":"2026-08-07T05:35:58.309187Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:58.156476Z","title":null,"venue":null,"work_id":"611410b3-9b0c-4f20-a06e-bca5450de324","year":2023},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.088265Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:a65e1e6b9808270b3fae9e51646681f12fb7fa66e91e6159fd0bc28b7a65b5cb","observation_id":"53b664c2-62ca-435d-9da8-69db3c71243c","resolution":{"observed_at":"2026-08-07T05:35:58.161373Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:58.140391Z","title":null,"venue":null,"work_id":"fa9db0a4-d00f-4be7-995b-096b47dbcb24","year":2019},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.095984Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:665f07cd4678eaa7989931cdce3b2c55458543dfe133e621a832cdea996e6251","observation_id":"bf648cfb-dacd-402a-a849-e20e7654c246","resolution":{"observed_at":"2026-08-07T05:35:58.145668Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:58.123076Z","title":null,"venue":null,"work_id":"6f71bcae-84fb-47db-a559-ea129b375fb0","year":2023},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.103348Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:11aca55ca43895add36977c1d91db732876138fb0a4563e4123defbb83649da0","observation_id":"a4251c64-03ba-4e4a-91af-03f5ed8a92fe","resolution":{"observed_at":"2026-08-07T05:35:58.128848Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:58.103200Z","title":null,"venue":null,"work_id":"8c7c0f6d-9294-4fe6-a1ea-156431299105","year":2023},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.113932Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:3c8c4143ad5f5ec033a30b757f10d6a23092e2509e6be8bc8bdd48f5475cee3f","observation_id":"4da2dbbb-bc38-42d3-ac50-aa998010b9c4","resolution":{"observed_at":"2026-08-07T05:35:58.111984Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:58.085013Z","title":null,"venue":null,"work_id":"8f068b8e-bf28-417f-870a-13347d6330e7","year":2022},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.120182Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:2ea301fbe6fbf4390b052bcd5dbed2f22e2a72afc940740ee1e134cc10d55e65","observation_id":"f9b4c42e-f2c1-42c8-8bdc-1196f03ac982","resolution":{"observed_at":"2026-08-07T05:35:58.092139Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.126826Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.126826Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:9c1326a251db77948454a375d721b048e4b393a0dd5dcf932f1ee241a4f5a525","observation_id":"354074a8-8b33-4d52-8d9c-a61dbf87c34e","resolution":{"observed_at":"2026-08-07T05:35:57.126826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:58.030988Z","title":null,"venue":null,"work_id":"30848d60-87e7-4a8c-b6c5-12a5d7f563a3","year":2023},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.132725Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:052d072f0dff14bd9d59be469c0a4097a7bf39d572f9d295d47e65cd6bec6903","observation_id":"26f32afd-70d9-4b81-a80b-5971775465af","resolution":{"observed_at":"2026-08-07T05:35:58.035865Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:58.010593Z","title":null,"venue":null,"work_id":"a0a36eaf-ddc1-4840-9330-d04f62fda219","year":2021},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.137783Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:7a752f32532d79aede23c2ac127ed0bf80b2b023cf71f4288bdc95e7a8e052b9","observation_id":"fbde422b-b935-4902-896c-062ddf7c6141","resolution":{"observed_at":"2026-08-07T05:35:58.017813Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.992127Z","title":null,"venue":null,"work_id":"8bdd8e43-6d9b-4fe8-9289-e597a876134e","year":2022},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.144032Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:8f6beec5332129519725576711ed889ab33080e39ea685c4b8f28396ee1838a6","observation_id":"470d7524-a7df-4035-9519-f202c9e2d9e6","resolution":{"observed_at":"2026-08-07T05:35:57.997224Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.150222Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.150222Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:172d247bc720a284d96f0bcb51d8766f1a5eb153b9e44d18409f13cf7d2593c3","observation_id":"dea5fec2-ace0-4fb2-8d48-b8b1ce230063","resolution":{"observed_at":"2026-08-07T05:35:57.150222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.961096Z","title":null,"venue":null,"work_id":"62c2c3d9-9863-4266-a46b-da3cbed34f9a","year":2020},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.160237Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:e533e69d3c7bf28a42a57b193e54f32dc719842cd0dd0de15dc9f006802fa935","observation_id":"1590cc6e-bee8-4c78-acd3-b7ef5947cf43","resolution":{"observed_at":"2026-08-07T05:35:57.966223Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.943309Z","title":null,"venue":null,"work_id":"86d668b7-6275-4768-a5be-36df505d8132","year":null},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.166985Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:d30d2f551c1cea2e5c83846079eee6329f940daffe10a9d531e3ef27d06738e8","observation_id":"f101179c-c06e-4d35-8e72-19cb76eefe9c","resolution":{"observed_at":"2026-08-07T05:35:57.948515Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.908778Z","title":null,"venue":null,"work_id":"13aed5e8-daed-45dd-92ab-31a68ced6952","year":2018},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.179138Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:0b1fee24bf9d11effe59c2861526d7e25974b8ba649df0ef81039923d4c5f33a","observation_id":"d4eae0de-f472-420a-b300-8d3a18106131","resolution":{"observed_at":"2026-08-07T05:35:57.914080Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.890151Z","title":null,"venue":null,"work_id":"b783e0df-5f11-4306-8d42-eb92b069b3fe","year":2022},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.184406Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:2994594d67d62c971e1e07426fa7945f6a5cf4f6f416e52d02764195358fea89","observation_id":"1121a258-68b8-4379-aa67-9667fe426e95","resolution":{"observed_at":"2026-08-07T05:35:57.895640Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.870692Z","title":null,"venue":null,"work_id":"f15809d4-2adc-42f7-abb7-3647c1676291","year":2022},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.191716Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:9b14b009c48f85aae6ad50bae1aa8f326c9375df69f8eb7ee723d22b892a88c2","observation_id":"a427b2e4-1dbc-4b90-bfaf-0f81da41ddb1","resolution":{"observed_at":"2026-08-07T05:35:57.877689Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.197083Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.197083Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:794f684a8cf4c345c4681e1a763b3ed607bf8b45d039caacb1d0fd21c4cc57bd","observation_id":"bc88e370-ae07-4c56-b150-052dc579e460","resolution":{"observed_at":"2026-08-07T05:35:57.197083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.206670Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.206670Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:91a2480efa7c1e5ab2d2d7f421a4d9c001225c11d6388102cdf6c16e67084672","observation_id":"2f00fa71-bf0a-40e1-a958-44b21f792384","resolution":{"observed_at":"2026-08-07T05:35:57.206670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.813339Z","title":null,"venue":null,"work_id":"059f8da1-b3ca-4fcb-9aea-962dcb8286af","year":2021},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.215069Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:5a19fea2d4b308a82488e78dad0a4d3694ac0eb0ebb49c3ab1de475e4692d842","observation_id":"788fa52f-9162-4cff-b176-f60d626a90e5","resolution":{"observed_at":"2026-08-07T05:35:57.820128Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.220366Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.220366Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:e17aa933c376d62d305f2ff35c11090cd6636982dab6b9b66d4039f3a3ce4000","observation_id":"90ea609c-e7db-445b-95e1-9e6921c11286","resolution":{"observed_at":"2026-08-07T05:35:57.220366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.225611Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.225611Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:bd2b1c1c7f5adc2b24bc7a3bf9f7fde47605f1d97a6ee8e6a89bf14d7518d741","observation_id":"dc1ffd32-9edc-4a41-9024-22be2e53a4e1","resolution":{"observed_at":"2026-08-07T05:35:57.225611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.230588Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.230588Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:f65a7facd965a7548c160c3865a770e30e3e7df8d0b1ea269b7a4ace15f50052","observation_id":"70918cf4-e3e9-4637-8ffa-0d87187c536b","resolution":{"observed_at":"2026-08-07T05:35:57.230588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.712534Z","title":null,"venue":null,"work_id":"8e6b4027-cc15-4cb5-9c54-909ed23f229b","year":2022},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.235321Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:5f5f9ace52b38e9106c1150661c053dd443518094b22accdb73131f806a72396","observation_id":"5d9ee621-5a46-44e1-8d09-c277063db70c","resolution":{"observed_at":"2026-08-07T05:35:57.725394Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.692580Z","title":null,"venue":null,"work_id":"c3151e91-92c9-4196-a395-7292bf0634e3","year":2020},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.242431Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:18857887a7751be9a07141a12a4e42baa1189c0266341f678c4e016ebcd29a0f","observation_id":"c322f1d2-07ee-4fde-a948-149938f1d50a","resolution":{"observed_at":"2026-08-07T05:35:57.698413Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.674854Z","title":null,"venue":null,"work_id":"b108bcf8-551f-4dd2-9022-4a0d25f44bf8","year":null},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.249202Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:9d4f8b3b853f0aa929e359afa4255f02caa349b816359aeb08d860e4cacdf10a","observation_id":"1169788e-b549-4365-b5ba-34f8f7ec2c89","resolution":{"observed_at":"2026-08-07T05:35:57.680512Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.622397Z","title":null,"venue":null,"work_id":"e878d638-6b77-4a89-a2ad-a39caca6edf8","year":2018},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.260282Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:78ee0a432630219f3baeb6672d09865a109434e335cd8d20bdb6c42a6d1c6094","observation_id":"89820a97-ee12-410d-9b46-9821a2bda3ce","resolution":{"observed_at":"2026-08-07T05:35:57.631626Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.599839Z","title":null,"venue":null,"work_id":"81aa04e8-7c53-4fa1-b115-1d6a55620daf","year":2023},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.266797Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:47bd5692a3a4f3ba834e35e32cbe2d4f68903bf947b74674ffb0cf7268306b16","observation_id":"715009ab-048d-48f2-baa6-6c8494bdc026","resolution":{"observed_at":"2026-08-07T05:35:57.606362Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.565632Z","title":null,"venue":null,"work_id":"b125a1f3-dc36-4050-ad40-c69826f9537e","year":2023},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.274968Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:6b8e397e383be1c51f8741864db24c6f33df1bbb479e4f16743558a7be16ccc9","observation_id":"e7875f2b-c96e-4309-afb2-e7f681e95ea4","resolution":{"observed_at":"2026-08-07T05:35:57.580080Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.545816Z","title":null,"venue":null,"work_id":"e0e48e9c-7a44-438a-8063-711c8532e841","year":null},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.280993Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:426b3665437dd7797afb7bc52aed3588842a231bb375965218e203a83229bb14","observation_id":"66c76283-e477-46eb-a299-217b0738fed5","resolution":{"observed_at":"2026-08-07T05:35:57.552253Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.525387Z","title":null,"venue":null,"work_id":"3e6ad2d0-ae5a-4958-99c4-0b56814ff14f","year":2024},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.300082Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:480c1092050a61901e4de08c5057bb81f56b44d62eba15d26da36fa74b490aa1","observation_id":"4862a76f-6345-4997-82e5-77eb5a6ebb4f","resolution":{"observed_at":"2026-08-07T05:35:57.531427Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.495086Z","title":null,"venue":null,"work_id":"c8fa9fc8-f49e-41d0-905e-ad5c52bddc9e","year":2019},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.307772Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:5a3d0dfe85ec76dfdcada9995cf6f6dabb8679096972405e9c4c8347985c2d9e","observation_id":"08a41abf-da37-4fcc-aaa3-ea388fa2ae5b","resolution":{"observed_at":"2026-08-07T05:35:57.504716Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.472094Z","title":null,"venue":null,"work_id":"b2f38df0-3377-490a-860e-23e5a9114b39","year":2019},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.316431Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:9970d391d420ff20d8983ae8fe7d11b77548cd816fa01eb59e7ab73845d9a30a","observation_id":"2f895f5b-1aa1-4b15-8599-77b26ff499b0","resolution":{"observed_at":"2026-08-07T05:35:57.478434Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.326726Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.326726Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:51854cee4c5cba365a08e8f2ce1e15eb5fd6d16150f122481ad1e17d0e9dfa06","observation_id":"8b76feed-3495-4390-ab03-ba5b351b4b50","resolution":{"observed_at":"2026-08-07T05:35:57.326726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v33i01.33019211","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.381143Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence 33, 01 (Jul","venue":null,"work_id":"86652c4b-b4e0-47ff-9ff2-50d9cf456a9f","year":2019},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.289490Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:80a10fbce77e2ae41d0fed0e08e53819a22bd89665252b765a1e5c9b808a45c4","observation_id":"7ac54ca7-8f25-4f03-a85b-b8a5d06388f7","resolution":{"observed_at":"2026-08-07T05:35:57.389052Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.927318Z","title":"In Computer Vision–ECCV 2020: 16th European Conference, Glasgow, UK, August 23–28, 2020, Proceedings, Part II 16","venue":null,"work_id":"3fb0d236-e9bc-4096-af62-92a546e45b2a","year":2020},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.174169Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:8c9dc8fac0fafbf40dd180200ddec5a99793e147184c62e85f98968de60a0935","observation_id":"1a5aad98-d0ee-4af2-9923-9b6387c2fd41","resolution":{"observed_at":"2026-08-07T05:35:57.932506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.655799Z","title":"In Proceedings of the IEEE/CVF international conference on computer vision","venue":null,"work_id":"9736c518-d492-4b22-8b8d-a0b9a097d02d","year":null},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.254754Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:0a26f067095090d5c0b0f898b53c71ae712ed6b589925c3aeb9f493b9213f306","observation_id":"56706786-c0ea-45a4-b220-c1fef049b257","resolution":{"observed_at":"2026-08-07T05:35:57.661819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:35:57.019896Z","title":"In Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:57.019896Z"},"links":{"citing_paper":"/paper/2506.07572"},"observation_digest":"sha256:3f3aae6729b2d2a949f8de6adb26ea8a50b08569031236345e385528cdb2642b","observation_id":"91e59231-572b-4ca6-997d-06fbffa0973c","resolution":{"observed_at":"2026-08-07T05:35:57.019896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.07572","last_updated":"2025-06-09T09:16:14Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T05:28:06.934011Z","submitted_at":"2025-06-09T09:16:14Z","title":"Learning Speaker-Invariant Visual Features for Lipreading"},"reference_resolution":{"displayed":53,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":50,"verified_exact":1,"verified_fuzzy":2},"total_outbound_references":53},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 53 of 53 outbound references and 0 inbound Pith citation observations for arXiv:2506.07572."}