{"as_of":"2026-08-23T19:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6237a626f83ded055315cec1c2ec09e7533cb023ba23e9cf32e24936e0ce87ab","coverage":[{"denominator":76,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":76,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T20:31:46.008638Z","state":"measured"},{"denominator":116,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":116,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":40,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T23:28:34.680292Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":3,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09595","snapshot_observed_at":"2026-08-11T20:17:52.686270Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.05899","last_updated":"2024-12-08T11:36:32Z","snapshot_observed_at":"2026-08-14T20:30:41.597939Z","submitted_at":"2024-12-08T11:36:32Z","title":"Accelerating Video Diffusion Models via Distribution Matching","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T20:17:52.686270Z"},"links":{"cited_paper":"/paper/2411.09595","citing_paper":"/paper/2412.05899"},"observation_digest":"sha256:3e4510aaaa244091fff144e44e35c9730369ad237c2fa50451da7d19b2353983","observation_id":"fe1bd1c6-43fb-466d-846f-a7c0ab5720e8","resolution":{"observed_at":"2026-08-11T20:17:52.686270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09595","snapshot_observed_at":"2026-08-15T23:28:34.680292Z","title":"Advances in Neural Information Processing Systems 35 (2022), 10021–10039","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.04622","last_updated":"2025-05-07T17:59:46Z","snapshot_observed_at":"2026-08-18T02:41:55.605290Z","submitted_at":"2025-05-07T17:59:46Z","title":"PrimitiveAnything: Human-Crafted 3D Primitive Assembly Generation with Auto-Regressive Transformer","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-15T23:28:34.680292Z"},"links":{"cited_paper":"/paper/2411.09595","citing_paper":"/paper/2505.04622"},"observation_digest":"sha256:8b8d5fa5e57da33a7c80706d3e9a54bbbaef8c145c45df4df8f303aa27838d50","observation_id":"03939fbb-8c04-407d-855b-c3efd27b285d","resolution":{"observed_at":"2026-08-15T23:28:34.680292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09595","snapshot_observed_at":"2026-08-15T22:13:47.433729Z","title":"Llama-mesh: Unifying 3d mesh generation with language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.07747","last_updated":"2025-05-12T16:56:30Z","snapshot_observed_at":"2026-08-19T18:23:10.157981Z","submitted_at":"2025-05-12T16:56:30Z","title":"Step1X-3D: Towards High-Fidelity and Controllable Generation of Textured 3D Assets","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-15T22:13:47.433729Z"},"links":{"cited_paper":"/paper/2411.09595","citing_paper":"/paper/2505.07747"},"observation_digest":"sha256:be6c6571cdf544f182e12e055ed48192b093e1e2a9f2c2da76994c031fe9d0bf","observation_id":"c57ab5ec-8667-4e68-9d35-2c049b8dc19c","resolution":{"observed_at":"2026-08-15T22:13:47.433729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09595","snapshot_observed_at":"2026-08-07T15:37:32.814459Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14521","last_updated":"2025-06-12T04:10:04Z","snapshot_observed_at":"2026-08-17T07:30:42.737904Z","submitted_at":"2025-05-20T15:44:54Z","title":"Sparc3D: Sparse Representation and Construction for High-Resolution 3D Shapes Modeling","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:37:32.814459Z"},"links":{"cited_paper":"/paper/2411.09595","citing_paper":"/paper/2505.14521"},"observation_digest":"sha256:714f1abd774bf87ab5303dac55814c0190ece76e9edbc01f18fb35984d6dd5a4","observation_id":"40ecd4eb-eee8-47bd-88ca-587cbecd58ba","resolution":{"observed_at":"2026-08-07T15:37:32.814459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09595","snapshot_observed_at":"2026-08-07T11:37:28.108498Z","title":"Llama-mesh: Unifying 3d mesh generation with language models.arXiv preprint arXiv:2411.09595, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01853","last_updated":"2025-06-02T16:40:50Z","snapshot_observed_at":"2026-08-23T03:22:47.363071Z","submitted_at":"2025-06-02T16:40:50Z","title":"ShapeLLM-Omni: A Native Multimodal LLM for 3D Generation and Understanding","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T11:37:28.108498Z"},"links":{"cited_paper":"/paper/2411.09595","citing_paper":"/paper/2506.01853"},"observation_digest":"sha256:093d67bb0f9b60aafeb8ca20208b8bdbf01bd54fc66fe90f75b9e7b0924b9aa8","observation_id":"7c388385-c785-46f1-8863-7b6063936576","resolution":{"observed_at":"2026-08-07T11:37:28.108498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09595","snapshot_observed_at":"2026-08-07T10:17:59.920719Z","title":"Llama-mesh: Unifying 3d mesh generation with language models.arXiv preprint arXiv:2411.09595, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05573","last_updated":"2025-06-05T20:30:28Z","snapshot_observed_at":"2026-08-16T16:58:09.756289Z","submitted_at":"2025-06-05T20:30:28Z","title":"PartCrafter: Structured 3D Mesh Generation via Compositional Latent Diffusion Transformers","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T10:17:59.920719Z"},"links":{"cited_paper":"/paper/2411.09595","citing_paper":"/paper/2506.05573"},"observation_digest":"sha256:75e315fe386494d88bfe75954896ecb87c2c6bad89e7ec808c3377f81e045f43","observation_id":"4a52754e-1903-4863-8a81-59ec9bda32c9","resolution":{"observed_at":"2026-08-07T10:17:59.920719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09595","snapshot_observed_at":"2026-08-07T04:52:15.458938Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.11148","last_updated":"2025-06-11T10:06:21Z","snapshot_observed_at":"2026-08-22T20:01:10.337207Z","submitted_at":"2025-06-11T10:06:21Z","title":"LLM-to-Phy3D: Physically Conform Online 3D Object Generation with LLMs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:15.458938Z"},"links":{"cited_paper":"/paper/2411.09595","citing_paper":"/paper/2506.11148"},"observation_digest":"sha256:8060955eeb04b682da78e0bbc279c7efefdc5a4c5af45a33c5c0c2aadf73c832","observation_id":"983b5aed-8427-4e90-82c8-c46cb05f8c14","resolution":{"observed_at":"2026-08-07T04:52:15.458938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09595","snapshot_observed_at":"2026-08-06T19:54:46.738568Z","title":"Llama-mesh: Unifying 3d mesh generation with language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04403","last_updated":"2025-07-06T14:30:08Z","snapshot_observed_at":"2026-08-18T00:05:50.306012Z","submitted_at":"2025-07-06T14:30:08Z","title":"Sat2City: 3D City Generation from A Single Satellite Image with Cascaded Latent Diffusion","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:46.738568Z"},"links":{"cited_paper":"/paper/2411.09595","citing_paper":"/paper/2507.04403"},"observation_digest":"sha256:513d90570e66a2e86e914542cbee9a51f63978b708ad2ca18dde4ea83f33c146","observation_id":"09e0b838-d792-4b85-85df-a39a71eaa3df","resolution":{"observed_at":"2026-08-06T19:54:46.738568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09595","snapshot_observed_at":"2026-08-15T18:21:12.441461Z","title":"Xinyue Wei, Kai Zhang, Sai Bi, Hao Tan, Fujun Luan, Valentin Deschaintre, Kalyan Sunkavalli, Hao Su, and Zexiang Xu","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.17745","last_updated":"2025-07-31T15:39:27Z","snapshot_observed_at":"2026-08-18T21:34:04.611204Z","submitted_at":"2025-07-23T17:57:16Z","title":"Ultra3D: Efficient and High-Fidelity 3D Generation with Part Attention","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T18:21:12.441461Z"},"links":{"cited_paper":"/paper/2411.09595","citing_paper":"/paper/2507.17745"},"observation_digest":"sha256:8d9203c02d61ca403e17b45da00d48b9d8b344752c38ef58bd0e795be2e4b0ec","observation_id":"c088d4d4-b24a-457f-b445-9a67d7159ba7","resolution":{"observed_at":"2026-08-15T18:21:12.441461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09595","snapshot_observed_at":"2026-08-15T18:10:21.363960Z","title":"Advances in Neural Information Processing Systems 35 (2022), 10021–10039","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.18939","last_updated":"2025-07-25T04:20:04Z","snapshot_observed_at":"2026-08-21T23:21:34.518718Z","submitted_at":"2025-07-25T04:20:04Z","title":"PDT: Point Distribution Transformation with Diffusion Models","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-15T18:10:21.363960Z"},"links":{"cited_paper":"/paper/2411.09595","citing_paper":"/paper/2507.18939"},"observation_digest":"sha256:3d8ce881e15ab4cddf9ef13febaf6fd062a47c9d935abb5c7f2a16a06dfb9c54","observation_id":"29f6211d-1998-4066-8e02-406d661df94f","resolution":{"observed_at":"2026-08-15T18:10:21.363960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09595","snapshot_observed_at":"2026-08-06T05:46:03.090481Z","title":"Llama-mesh: Unifying 3d mesh generation with language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01242","last_updated":"2025-08-05T05:55:00Z","snapshot_observed_at":"2026-08-15T12:32:39.627023Z","submitted_at":"2025-08-02T07:37:37Z","title":"MeshLLM: Empowering Large Language Models to Progressively Understand and Generate 3D Mesh","version":2},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-06T05:46:03.090481Z"},"links":{"cited_paper":"/paper/2411.09595","citing_paper":"/paper/2508.01242"},"observation_digest":"sha256:6c062b2e864f61e368cf974d24a8308920f48ce1536226ccd90b0cb4b7dc8398","observation_id":"c5decc28-7e10-45bf-a3ff-376ab40087a3","resolution":{"observed_at":"2026-08-06T05:46:03.090481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09595","snapshot_observed_at":"2026-08-05T21:39:13.851842Z","title":"Llama- mesh: Mesh generation using autoregressive language mod- els","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.08228","last_updated":"2025-08-11T17:48:02Z","snapshot_observed_at":"2026-08-17T06:28:48.811236Z","submitted_at":"2025-08-11T17:48:02Z","title":"LL3M: Large Language 3D Modelers","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-05T21:39:13.851842Z"},"links":{"cited_paper":"/paper/2411.09595","citing_paper":"/paper/2508.08228"},"observation_digest":"sha256:82e2325ba27f6b759057f339b36c3d27f22e6ee248aa5cef7409f5f6a03bb6d8","observation_id":"0add124c-120e-4803-878b-57feee3694cd","resolution":{"observed_at":"2026-08-05T21:39:13.851842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09595","snapshot_observed_at":"2026-08-05T20:40:07.412564Z","title":"InProceedings of the AAAI Conference on Artificial Intelligence, Vol","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10201","last_updated":"2026-07-18T10:35:55Z","snapshot_observed_at":"2026-08-20T21:10:52.686874Z","submitted_at":"2025-08-13T21:23:56Z","title":"B-repLer: Language-guided Editing of CAD Models","version":4},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-05T20:40:07.412564Z"},"links":{"cited_paper":"/paper/2411.09595","citing_paper":"/paper/2508.10201"},"observation_digest":"sha256:1483f14c66b52d6301131448937e23d3efc54b56ee2436d9f6d304c5bc7e833e","observation_id":"3541bd03-9d52-4740-a58d-016d0112717c","resolution":{"observed_at":"2026-08-05T20:40:07.412564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"cited_work":{"arxiv_id":"2411.09595","doi":"10.48550/arxiv.2411.09595","metadata_source":"pith","pith_arxiv_id":"2411.09595","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLaMA-Mesh: Unifying 3d mesh generation with language models","venue":"cs.LG","work_id":"3e953850-e5ac-440c-9256-8c5fb6f2e770","year":2024},"citing_paper":{"arxiv_id":"2511.18801","last_updated":"2026-07-30T14:58:39Z","snapshot_observed_at":"2026-08-20T21:17:15.592110Z","submitted_at":"2025-11-24T06:11:21Z","title":"PartDiffuser: Part-wise 3D Mesh Generation via Discrete Diffusion","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-21T18:37:14.113436Z"},"links":{"cited_paper":"/paper/2411.09595","citing_paper":"/paper/2511.18801"},"observation_digest":"sha256:a182191f80e873110e86a2b513f166ec7af667e24acaaafc2e5abe6d7fae5504","observation_id":"daeba6fc-cf30-4555-9094-d2b4bf3d4226","resolution":{"observed_at":"2026-05-21T18:40:29.032538Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09595","snapshot_observed_at":"2026-08-03T20:41:16.036111Z","title":"Llama-mesh: Unifying 3d mesh generation with language models.arXiv preprint arXiv:2411.09595, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.18801","last_updated":"2026-07-30T14:58:39Z","snapshot_observed_at":"2026-08-20T21:17:15.592110Z","submitted_at":"2025-11-24T06:11:21Z","title":"PartDiffuser: Part-wise 3D Mesh Generation via Discrete Diffusion","version":4},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-03T20:41:16.036111Z"},"links":{"cited_paper":"/paper/2411.09595","citing_paper":"/paper/2511.18801"},"observation_digest":"sha256:a031d6e138616941335ba9729f5b5e74146ce295d63adff833ff3b79a98f1437","observation_id":"3c5c6df6-2321-4650-a1ee-621b802343cd","resolution":{"observed_at":"2026-08-03T20:41:16.036111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"cited_work":{"arxiv_id":"2411.09595","doi":"10.48550/arxiv.2411.09595","metadata_source":"pith","pith_arxiv_id":"2411.09595","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLaMA-Mesh: Unifying 3d mesh generation with language models","venue":"cs.LG","work_id":"3e953850-e5ac-440c-9256-8c5fb6f2e770","year":2024},"citing_paper":{"arxiv_id":"2601.21798","last_updated":"2026-05-15T11:47:00Z","snapshot_observed_at":"2026-08-02T04:56:07.337606Z","submitted_at":"2026-01-29T14:42:46Z","title":"CG-MLLM: Captioning and Generating 3D content via Multi-modal Large Language Models","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-21T14:48:21.787919Z"},"links":{"cited_paper":"/paper/2411.09595","citing_paper":"/paper/2601.21798"},"observation_digest":"sha256:0a9f8a432d57890c2c4890a9ea3d79221068553f50fe7ad040854e348a457b3b","observation_id":"c2b4716c-e382-420f-8c34-87f9e7a5fe59","resolution":{"observed_at":"2026-05-21T14:50:14.688389Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"cited_work":{"arxiv_id":"2411.09595","doi":"10.48550/arxiv.2411.09595","metadata_source":"pith","pith_arxiv_id":"2411.09595","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLaMA-Mesh: Unifying 3d mesh generation with language models","venue":"cs.LG","work_id":"3e953850-e5ac-440c-9256-8c5fb6f2e770","year":2024},"citing_paper":{"arxiv_id":"2603.27309","last_updated":"2026-05-20T08:12:01Z","snapshot_observed_at":"2026-08-17T08:37:14.052216Z","submitted_at":"2026-03-28T15:30:24Z","title":"MeshTailor: Cutting Seams via Generative Mesh Traversal","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-21T11:06:07.307713Z"},"links":{"cited_paper":"/paper/2411.09595","citing_paper":"/paper/2603.27309"},"observation_digest":"sha256:646ef85130300815dc1bbfbe6c48308426609b8d47c228de9c9b364c0d0639ec","observation_id":"574d1f05-9702-4483-bb47-cb605c26b393","resolution":{"observed_at":"2026-05-21T11:10:02.258696Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09595","snapshot_observed_at":"2026-07-13T14:23:14.241724Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.01478","last_updated":"2026-05-28T14:28:04Z","snapshot_observed_at":"2026-08-13T10:16:32.325423Z","submitted_at":"2026-04-01T23:35:28Z","title":"Twisted Fiber Bundle Codes over Group Algebras","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-07-13T14:23:14.241724Z"},"links":{"cited_paper":"/paper/2411.09595","citing_paper":"/paper/2604.01478"},"observation_digest":"sha256:f8513de4ce2e999b1905c68ce94b81092ee9d1507dce9f88310074dad647d926","observation_id":"3f1b7b9c-3b29-48ea-adce-30b68472fd9c","resolution":{"observed_at":"2026-07-13T14:23:14.241724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"cited_work":{"arxiv_id":"2411.09595","doi":"10.48550/arxiv.2411.09595","metadata_source":"pith","pith_arxiv_id":"2411.09595","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLaMA-Mesh: Unifying 3d mesh generation with language models","venue":"cs.LG","work_id":"3e953850-e5ac-440c-9256-8c5fb6f2e770","year":2024},"citing_paper":{"arxiv_id":"2604.01479","last_updated":"2026-04-03T02:02:55Z","snapshot_observed_at":"2026-08-08T07:52:55.097673Z","submitted_at":"2026-04-01T23:35:40Z","title":"UniRecGen: Unifying Multi-View 3D Reconstruction and Generation","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-05-13T22:12:52.334139Z"},"links":{"cited_paper":"/paper/2411.09595","citing_paper":"/paper/2604.01479"},"observation_digest":"sha256:6b6985248d303f24b1c15ddaa22bee218e44002a7ea976d3536572379356d2a3","observation_id":"401debc6-5716-4414-b188-4443a8ec991d","resolution":{"observed_at":"2026-05-13T22:13:20.834711Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"cited_work":{"arxiv_id":"2411.09595","doi":"10.48550/arxiv.2411.09595","metadata_source":"pith","pith_arxiv_id":"2411.09595","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLaMA-Mesh: Unifying 3d mesh generation with language models","venue":"cs.LG","work_id":"3e953850-e5ac-440c-9256-8c5fb6f2e770","year":2024},"citing_paper":{"arxiv_id":"2604.03305","last_updated":"2026-03-31T01:28:42Z","snapshot_observed_at":"2026-08-11T13:57:25.338529Z","submitted_at":"2026-03-31T01:28:42Z","title":"HVG-3D: Bridging Real and Simulation Domains for 3D-Conditional Hand-Object Interaction Video Synthesis","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-14T00:14:36.537688Z"},"links":{"cited_paper":"/paper/2411.09595","citing_paper":"/paper/2604.03305"},"observation_digest":"sha256:7396879ccd387ca0fbd5c065171d790490b53e3820e068d9d8943000c8626f9a","observation_id":"5bdcd9af-912a-4a11-acc4-b315d3ae7671","resolution":{"observed_at":"2026-05-14T00:18:30.095637Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"cited_work":{"arxiv_id":"2411.09595","doi":"10.48550/arxiv.2411.09595","metadata_source":"pith","pith_arxiv_id":"2411.09595","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLaMA-Mesh: Unifying 3d mesh generation with language models","venue":"cs.LG","work_id":"3e953850-e5ac-440c-9256-8c5fb6f2e770","year":2024},"citing_paper":{"arxiv_id":"2604.11792","last_updated":"2026-04-13T17:55:40Z","snapshot_observed_at":"2026-08-14T06:41:03.971183Z","submitted_at":"2026-04-13T17:55:40Z","title":"LottieGPT: Tokenizing Vector Animation for Autoregressive Generation","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-10T15:25:28.782101Z"},"links":{"cited_paper":"/paper/2411.09595","citing_paper":"/paper/2604.11792"},"observation_digest":"sha256:2b96d7cf18df139668980259087c46fac28283d718fa943561f50879cd2e40b3","observation_id":"0d656204-da87-4f77-bc7f-84c9ff02f6d7","resolution":{"observed_at":"2026-05-11T10:36:03.814368Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"cited_work":{"arxiv_id":"2411.09595","doi":"10.48550/arxiv.2411.09595","metadata_source":"pith","pith_arxiv_id":"2411.09595","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLaMA-Mesh: Unifying 3d mesh generation with language models","venue":"cs.LG","work_id":"3e953850-e5ac-440c-9256-8c5fb6f2e770","year":2024},"citing_paper":{"arxiv_id":"2605.10438","last_updated":"2026-05-11T12:09:28Z","snapshot_observed_at":"2026-08-11T02:49:27.828058Z","submitted_at":"2026-05-11T12:09:28Z","title":"Beyond Spatial Compression: Interface-Centric Generative States for Open-World 3D Structure","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-12T04:31:25.330754Z"},"links":{"cited_paper":"/paper/2411.09595","citing_paper":"/paper/2605.10438"},"observation_digest":"sha256:8abb196d90a3b437f85dd32b4487a854be520ced5062cbaf29204577078afe67","observation_id":"9eda6099-16e8-4257-9b08-7016634f3566","resolution":{"observed_at":"2026-05-12T06:11:24.298275Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"cited_work":{"arxiv_id":"2411.09595","doi":"10.48550/arxiv.2411.09595","metadata_source":"pith","pith_arxiv_id":"2411.09595","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLaMA-Mesh: Unifying 3d mesh generation with language models","venue":"cs.LG","work_id":"3e953850-e5ac-440c-9256-8c5fb6f2e770","year":2024},"citing_paper":{"arxiv_id":"2605.14594","last_updated":"2026-05-14T09:02:32Z","snapshot_observed_at":"2026-08-13T19:33:24.034750Z","submitted_at":"2026-05-14T09:02:32Z","title":"TOPOS: High-Fidelity and Efficient Industry-Grade 3D Head Generation","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-05-15T01:34:21.780341Z"},"links":{"cited_paper":"/paper/2411.09595","citing_paper":"/paper/2605.14594"},"observation_digest":"sha256:6514686e4ee0c8bd275b27bb73edc46cbbda880ee0323fd01f5675d4d5ed4c74","observation_id":"41c5556a-1bb6-4d51-8b94-5449385ab568","resolution":{"observed_at":"2026-05-15T01:38:27.713138Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"cited_work":{"arxiv_id":"2411.09595","doi":"10.48550/arxiv.2411.09595","metadata_source":"pith","pith_arxiv_id":"2411.09595","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLaMA-Mesh: Unifying 3d mesh generation with language models","venue":"cs.LG","work_id":"3e953850-e5ac-440c-9256-8c5fb6f2e770","year":2024},"citing_paper":{"arxiv_id":"2605.16745","last_updated":"2026-05-16T01:55:03Z","snapshot_observed_at":"2026-08-14T15:45:22.257635Z","submitted_at":"2026-05-16T01:55:03Z","title":"EVA01: Unified Native 3D Understanding and Generation via Mixture-of-Transformers","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-05-19T21:26:36.707554Z"},"links":{"cited_paper":"/paper/2411.09595","citing_paper":"/paper/2605.16745"},"observation_digest":"sha256:a4b4222a38430a82be7272a31304f02dc022b79fa8bde54d5f0c504fa06ba0d5","observation_id":"55cd3fa2-37bb-4edf-b783-33af7e557e17","resolution":{"observed_at":"2026-05-19T21:27:47.845615Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"cited_work":{"arxiv_id":"2411.09595","doi":"10.48550/arxiv.2411.09595","metadata_source":"pith","pith_arxiv_id":"2411.09595","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLaMA-Mesh: Unifying 3d mesh generation with language models","venue":"cs.LG","work_id":"3e953850-e5ac-440c-9256-8c5fb6f2e770","year":2024},"citing_paper":{"arxiv_id":"2605.16813","last_updated":"2026-07-01T09:02:12Z","snapshot_observed_at":"2026-08-14T22:21:26.436821Z","submitted_at":"2026-05-16T05:04:10Z","title":"QuadLink: Autoregressive Quad-Dominant Mesh Generation via Point-Relation Learning","version":1},"reference_index":161,"source":"arxiv_source","source_observed_at":"2026-05-19T19:48:38.423387Z"},"links":{"cited_paper":"/paper/2411.09595","citing_paper":"/paper/2605.16813"},"observation_digest":"sha256:0c5f3e8fe65b6e66368105ab1bebaa89ab405919f60de1cf940aa756d08dd8a0","observation_id":"06f2aa89-a8bc-463e-b3e5-8dacfedb5c76","resolution":{"observed_at":"2026-05-19T19:52:44.598176Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"cited_work":{"arxiv_id":"2411.09595","doi":"10.48550/arxiv.2411.09595","metadata_source":"pith","pith_arxiv_id":"2411.09595","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLaMA-Mesh: Unifying 3d mesh generation with language models","venue":"cs.LG","work_id":"3e953850-e5ac-440c-9256-8c5fb6f2e770","year":2024},"citing_paper":{"arxiv_id":"2605.17620","last_updated":"2026-05-13T16:00:50Z","snapshot_observed_at":"2026-08-15T15:54:36.700650Z","submitted_at":"2026-05-13T16:00:50Z","title":"SynVA: A Modular Toolkit for Vessel Generation and Aneurysm Editing","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-05-20T21:01:50.708962Z"},"links":{"cited_paper":"/paper/2411.09595","citing_paper":"/paper/2605.17620"},"observation_digest":"sha256:c848990a7f900551d3e3095b84f65eb36c46ce5a8b71f49b1683a0ff4ae2c236","observation_id":"4a8edd00-58c2-4c1f-b092-45c2ff4ebdea","resolution":{"observed_at":"2026-05-20T21:03:46.505353Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"cited_work":{"arxiv_id":"2411.09595","doi":"10.48550/arxiv.2411.09595","metadata_source":"pith","pith_arxiv_id":"2411.09595","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLaMA-Mesh: Unifying 3d mesh generation with language models","venue":"cs.LG","work_id":"3e953850-e5ac-440c-9256-8c5fb6f2e770","year":2024},"citing_paper":{"arxiv_id":"2605.21489","last_updated":"2026-05-21T21:50:17Z","snapshot_observed_at":"2026-08-15T14:13:58.147292Z","submitted_at":"2026-05-20T17:59:52Z","title":"Variance Reduction for Expectations with Diffusion Teachers","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-05-21T04:51:57.800006Z"},"links":{"cited_paper":"/paper/2411.09595","citing_paper":"/paper/2605.21489"},"observation_digest":"sha256:a53990872762061daafce1af724cd6f4852d626d25a1932ad226e5788bb1bdcc","observation_id":"afbe204c-186b-4e4d-a9c8-911f2c7c792f","resolution":{"observed_at":"2026-05-21T04:53:57.897861Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"cited_work":{"arxiv_id":"2411.09595","doi":"10.48550/arxiv.2411.09595","metadata_source":"pith","pith_arxiv_id":"2411.09595","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLaMA-Mesh: Unifying 3d mesh generation with language models","venue":"cs.LG","work_id":"3e953850-e5ac-440c-9256-8c5fb6f2e770","year":2024},"citing_paper":{"arxiv_id":"2605.21489","last_updated":"2026-05-21T21:50:17Z","snapshot_observed_at":"2026-08-15T14:13:58.147292Z","submitted_at":"2026-05-20T17:59:52Z","title":"Variance Reduction for Expectations with Diffusion Teachers","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-05-25T05:41:10.076206Z"},"links":{"cited_paper":"/paper/2411.09595","citing_paper":"/paper/2605.21489"},"observation_digest":"sha256:7e56f1d7762677cccb5b53b648e22d13ac44dc19fce30aee6f259dd1e2103885","observation_id":"71fdf6ce-0227-40bb-b492-6282bffc956a","resolution":{"observed_at":"2026-05-25T05:45:24.726308Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"cited_work":{"arxiv_id":"2411.09595","doi":"10.48550/arxiv.2411.09595","metadata_source":"pith","pith_arxiv_id":"2411.09595","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLaMA-Mesh: Unifying 3d mesh generation with language models","venue":"cs.LG","work_id":"3e953850-e5ac-440c-9256-8c5fb6f2e770","year":2024},"citing_paper":{"arxiv_id":"2605.21572","last_updated":"2026-05-20T17:59:01Z","snapshot_observed_at":"2026-08-12T21:19:57.922603Z","submitted_at":"2026-05-20T17:59:01Z","title":"PhysX-Omni: Unified Simulation-Ready Physical 3D Generation for Rigid, Deformable, and Articulated Objects","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-22T09:39:48.573379Z"},"links":{"cited_paper":"/paper/2411.09595","citing_paper":"/paper/2605.21572"},"observation_digest":"sha256:44401db02b1c350f8603a051086d9ee114800476968a707d6144c51aae6a6049","observation_id":"18c5bbba-56db-4b5b-8a1f-f8a6cf5f248d","resolution":{"observed_at":"2026-05-22T09:41:21.884335Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"cited_work":{"arxiv_id":"2411.09595","doi":"10.48550/arxiv.2411.09595","metadata_source":"pith","pith_arxiv_id":"2411.09595","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLaMA-Mesh: Unifying 3d mesh generation with language models","venue":"cs.LG","work_id":"3e953850-e5ac-440c-9256-8c5fb6f2e770","year":2024},"citing_paper":{"arxiv_id":"2606.24138","last_updated":"2026-06-23T04:46:04Z","snapshot_observed_at":"2026-08-01T14:22:41.078678Z","submitted_at":"2026-06-23T04:46:04Z","title":"Sat2City v2: Native 3D City Asset Generation from a Single Satellite Image","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-06-26T01:44:30.505560Z"},"links":{"cited_paper":"/paper/2411.09595","citing_paper":"/paper/2606.24138"},"observation_digest":"sha256:bdc92aa501734e7bf9e29283d098251b5e93a88ca72ac9d5a576af2aa5b8a37f","observation_id":"40cbb70b-13d7-44cc-a93c-d3cc3757da74","resolution":{"observed_at":"2026-07-04T15:19:56.369367Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"cited_work":{"arxiv_id":"2411.09595","doi":"10.48550/arxiv.2411.09595","metadata_source":"pith","pith_arxiv_id":"2411.09595","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLaMA-Mesh: Unifying 3d mesh generation with language models","venue":"cs.LG","work_id":"3e953850-e5ac-440c-9256-8c5fb6f2e770","year":2024},"citing_paper":{"arxiv_id":"2606.27305","last_updated":"2026-06-25T17:26:06Z","snapshot_observed_at":"2026-08-21T17:39:37.446563Z","submitted_at":"2026-06-25T17:26:06Z","title":"Sculpting NeRF Geometry: Human-Preference Fine-Tuning of a 3D-Aware Face GAN","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-06-26T05:33:57.816715Z"},"links":{"cited_paper":"/paper/2411.09595","citing_paper":"/paper/2606.27305"},"observation_digest":"sha256:6582e5cfe0fcca9e32cb5aa5d46ee163b12e0f3c1b3e36c8e66898d407a7003d","observation_id":"7b1659ec-1f07-49a4-8740-6b3c26a6f52c","resolution":{"observed_at":"2026-07-04T12:59:53.192534Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"cited_work":{"arxiv_id":"2411.09595","doi":"10.48550/arxiv.2411.09595","metadata_source":"pith","pith_arxiv_id":"2411.09595","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLaMA-Mesh: Unifying 3d mesh generation with language models","venue":"cs.LG","work_id":"3e953850-e5ac-440c-9256-8c5fb6f2e770","year":2024},"citing_paper":{"arxiv_id":"2606.31388","last_updated":"2026-06-30T09:16:21Z","snapshot_observed_at":"2026-08-02T07:18:38.830324Z","submitted_at":"2026-06-30T09:16:21Z","title":"One Video, One World: Turning Monocular Video into Physical 4D Scenes","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-07-01T05:38:19.541391Z"},"links":{"cited_paper":"/paper/2411.09595","citing_paper":"/paper/2606.31388"},"observation_digest":"sha256:b2eb88ad2a11a702496a38b5ee81e23b38b3fd325ec19709ca51fdf677434eb9","observation_id":"795f9733-e066-464c-b172-1662cf502bc2","resolution":{"observed_at":"2026-07-01T10:15:45.003610Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"cited_work":{"arxiv_id":"2411.09595","doi":"10.48550/arxiv.2411.09595","metadata_source":"pith","pith_arxiv_id":"2411.09595","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLaMA-Mesh: Unifying 3d mesh generation with language models","venue":"cs.LG","work_id":"3e953850-e5ac-440c-9256-8c5fb6f2e770","year":2024},"citing_paper":{"arxiv_id":"2607.06565","last_updated":"2026-07-07T17:59:50Z","snapshot_observed_at":"2026-08-12T23:58:05.299670Z","submitted_at":"2026-07-07T17:59:50Z","title":"ELSA3D: Elastic Semantic Anchoring for Unified 3D Understanding and Generation","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-07-08T01:40:40.690020Z"},"links":{"cited_paper":"/paper/2411.09595","citing_paper":"/paper/2607.06565"},"observation_digest":"sha256:0f66baf4c8f9610f44e0a27a1e95d22eba50b7138bbd90e808f344bb34a4826b","observation_id":"f6473b6b-16f1-4211-af20-9d06ecdd426e","resolution":{"observed_at":"2026-07-08T01:44:26.175237Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09595","snapshot_observed_at":"2026-07-13T06:42:45.558324Z","title":"arXiv preprint arXiv:2411.09595 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08798","last_updated":"2026-07-08T14:46:54Z","snapshot_observed_at":"2026-08-14T23:21:32.884772Z","submitted_at":"2026-07-08T14:46:54Z","title":"GReFEM: Multimodal LLMs as Zero-Shot Semantic Assistants for Physics-Guided 3D Mesh Refinement","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-07-13T06:42:45.558324Z"},"links":{"cited_paper":"/paper/2411.09595","citing_paper":"/paper/2607.08798"},"observation_digest":"sha256:ebcd51354332bc5ea2e032c0fad6cf582049fe9395746a5a52faeeaa73f3d773","observation_id":"c4485712-e147-48aa-8f36-07eb289b6278","resolution":{"observed_at":"2026-07-13T06:42:45.558324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09595","snapshot_observed_at":"2026-07-14T10:25:21.251496Z","title":"Llama-mesh: Unifying 3d mesh generation with language models.arXiv preprint arXiv:2411.09595,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10623","last_updated":"2026-07-20T15:29:09Z","snapshot_observed_at":"2026-08-17T22:10:38.111762Z","submitted_at":"2026-07-12T07:38:06Z","title":"LATO.2: Factorized 3D Mesh Generation with Vertex and Topology Flow","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-14T10:25:21.251496Z"},"links":{"cited_paper":"/paper/2411.09595","citing_paper":"/paper/2607.10623"},"observation_digest":"sha256:8ba971fd2b59c1294b780c264d4f11a4784b49fe3fb95a010025366e2dd8ae42","observation_id":"190ae89b-bed9-446b-8c7e-b2ba325f68c6","resolution":{"observed_at":"2026-07-14T10:25:21.251496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09595","snapshot_observed_at":"2026-08-02T07:15:50.119172Z","title":"Llama-mesh: Unifying 3d mesh generation with language models.arXiv preprint arXiv:2411.09595,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10623","last_updated":"2026-07-20T15:29:09Z","snapshot_observed_at":"2026-08-17T22:10:38.111762Z","submitted_at":"2026-07-12T07:38:06Z","title":"LATO.2: Factorized 3D Mesh Generation with Vertex and Topology Flow","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T07:15:50.119172Z"},"links":{"cited_paper":"/paper/2411.09595","citing_paper":"/paper/2607.10623"},"observation_digest":"sha256:d334751bd2535d011a5075909dbad30e729d408c7241e67ed954cce9a7359a49","observation_id":"2b328d26-92dc-4550-8f95-f0b22cb6e331","resolution":{"observed_at":"2026-08-02T07:15:50.119172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09595","snapshot_observed_at":"2026-08-02T04:53:59.822344Z","title":"arXiv preprint arXiv:2411.09595 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13563","last_updated":"2026-07-15T08:04:46Z","snapshot_observed_at":"2026-08-15T06:23:32.652395Z","submitted_at":"2026-07-15T08:04:46Z","title":"Nexus: Native Mesh Generation with Diffusion","version":1},"reference_index":103,"source":"arxiv_source","source_observed_at":"2026-08-02T04:53:59.822344Z"},"links":{"cited_paper":"/paper/2411.09595","citing_paper":"/paper/2607.13563"},"observation_digest":"sha256:53cc6d526b6748d9a771deb6dcc5726c7909b3d20e97bb7fcc4aa85fb3a78408","observation_id":"f40791d6-3a06-4b7b-a860-d5df33a27ed8","resolution":{"observed_at":"2026-08-02T04:53:59.822344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09595","snapshot_observed_at":"2026-08-01T09:10:33.814078Z","title":"arXiv preprint arXiv:2411.09595 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20889","last_updated":"2026-07-23T03:26:02Z","snapshot_observed_at":"2026-08-17T22:30:56.988683Z","submitted_at":"2026-07-23T03:26:02Z","title":"Engine-Native Editable 3D World Reconstruction with Objects and Lighting","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-01T09:10:33.814078Z"},"links":{"cited_paper":"/paper/2411.09595","citing_paper":"/paper/2607.20889"},"observation_digest":"sha256:7155fcac8241c51bc17cd46fc96443e70ba2a8aaac6a4131979ff2985db92ea5","observation_id":"6966107c-e42e-4952-80fc-4b2970eb07de","resolution":{"observed_at":"2026-08-01T09:10:33.814078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09595","snapshot_observed_at":"2026-08-10T05:06:51.987484Z","title":"LLaMA-Mesh: Unifying 3D mesh generation with language models.arXiv preprint arXiv:2411.09595, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07408","last_updated":"2026-08-07T16:55:57Z","snapshot_observed_at":"2026-08-19T18:40:13.295692Z","submitted_at":"2026-08-07T16:55:57Z","title":"Addressable Memory for Video World Models","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-10T05:06:51.987484Z"},"links":{"cited_paper":"/paper/2411.09595","citing_paper":"/paper/2608.07408"},"observation_digest":"sha256:55ab927aa3440b92ccfbd8d829b077d25e97f01ddae6f7935dc692b46737802d","observation_id":"44e33ebc-3b39-4e69-bb25-391ef2aca2a3","resolution":{"observed_at":"2026-08-10T05:06:51.987484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09595","snapshot_observed_at":"2026-08-12T00:33:58.586482Z","title":"LLaMA-Mesh: Unifying 3d mesh generation with language models.arXiv preprint arXiv:2411.09595, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08053","last_updated":"2026-08-08T10:39:09Z","snapshot_observed_at":"2026-08-23T10:26:09.089836Z","submitted_at":"2026-08-08T10:39:09Z","title":"PhysX-CoT: Structured Physical Reasoning from a Single Image to Simulation-Ready 3D Assets","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T00:33:58.586482Z"},"links":{"cited_paper":"/paper/2411.09595","citing_paper":"/paper/2608.08053"},"observation_digest":"sha256:40c3b41d755e38c7bc5208997d1f9ec53866df1adabe72dae168ac646f1452c6","observation_id":"7d57d097-158a-4451-af01-6dd9c93a99d2","resolution":{"observed_at":"2026-08-12T00:33:58.586482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2411.09595/citation-record","integrity":"/paper/2411.09595/integrity","json":"/paper/2411.09595/citation-record.json","paper":"/paper/2411.09595"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-12T20:31:45.703624Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.703624Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:aec449ff930008087bbab07e5dc9ebaa3d97de9bed59ba68467e2e7c7fa779b4","observation_id":"6b0298a9-b114-4686-bcdf-3baad3ca9191","resolution":{"observed_at":"2026-08-12T20:31:45.703624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:31:45.708606Z","title":"Flamingo: a visual language model for few-shot learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.708606Z"},"links":{"citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:33d79dc4fbd6d092250c43a78c8b333c36f136fbadc174dac4cd0c370c23349f","observation_id":"412dd92b-a043-4205-8bf1-f41479f4f2c8","resolution":{"observed_at":"2026-08-12T20:31:45.708606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-12T20:31:45.712178Z","title":"Qwen-vl: A versatile vision-language model for un- derstanding, localization, text reading, and beyond","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.712178Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:d1198196729d44db3e8849c424dbd708831f530396ee07f3cf28eea096002d3e","observation_id":"99ae6f10-f5d2-46cf-baff-fb481e8dc492","resolution":{"observed_at":"2026-08-12T20:31:45.712178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:31:46.874915Z","title":"Piqa: Reasoning about physical commonsense in nat- ural language","venue":null,"work_id":"adfa4a7a-daf9-4e82-8586-78a8d3db5aa6","year":2020},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.715974Z"},"links":{"citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:3d5c90dbf7447e82a716a09d56bc52731e353e262f715a82c9fd655eb3b8fd9a","observation_id":"c7b57a75-2d2a-4336-a0e9-cb3895853646","resolution":{"observed_at":"2026-08-12T20:31:46.878726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:31:45.720071Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.720071Z"},"links":{"citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:e300778438bfb9505e44e74fb433f82fc16ff8c42e76760e5a7ae2148c076417","observation_id":"e72bb9f1-b16b-48d3-b419-1e9188e8365b","resolution":{"observed_at":"2026-08-12T20:31:45.720071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.13873","last_updated":"2023-09-27T10:35:49Z","snapshot_observed_at":"2026-08-20T05:37:08.195267Z","submitted_at":"2023-03-24T09:30:09Z","title":"Fantasia3D: Disentangling Geometry and Appearance for High-quality Text-to-3D Content Creation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.13873","snapshot_observed_at":"2026-08-12T20:31:45.724245Z","title":"Fantasia3d: Disentangling geometry and appearance for high-quality text-to-3d content creation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.724245Z"},"links":{"cited_paper":"/paper/2303.13873","citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:ef137a8772368bae2c7cd09222bee4d0ead87c4e17300e789451acfda4a22337","observation_id":"51e215db-2646-4d16-b1dc-619f38af0f72","resolution":{"observed_at":"2026-08-12T20:31:45.724245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20853","last_updated":"2024-06-18T16:03:10Z","snapshot_observed_at":"2026-08-16T13:47:24.860575Z","submitted_at":"2024-05-31T14:35:35Z","title":"MeshXL: Neural Coordinate Field for Generative 3D Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20853","snapshot_observed_at":"2026-08-12T20:31:45.728952Z","title":"Meshxl: Neural coordinate field for generative 3d foundation models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.728952Z"},"links":{"cited_paper":"/paper/2405.20853","citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:04d203a196baa9e69a631a35ea71a2c8810192e778344a950357dc545ef71677","observation_id":"aebe7c4e-f338-49e5-af9c-68455064f87d","resolution":{"observed_at":"2026-08-12T20:31:45.728952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:31:45.733272Z","title":"It3d: Improved text- to-3d generation with explicit view synthesis, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.733272Z"},"links":{"citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:7bde418be050c91772cb865009900aac65a3f148b2713609673143fd5b3b496c","observation_id":"4ee47f7c-39a8-4011-a031-2f09bdca0b2e","resolution":{"observed_at":"2026-08-12T20:31:45.733272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10163","last_updated":"2024-10-09T05:00:16Z","snapshot_observed_at":"2026-08-19T19:26:15.318312Z","submitted_at":"2024-06-14T16:30:25Z","title":"MeshAnything: Artist-Created Mesh Generation with Autoregressive Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10163","snapshot_observed_at":"2026-08-12T20:31:45.737129Z","title":"Meshanything: Artist-created mesh generation with au- toregressive transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.737129Z"},"links":{"cited_paper":"/paper/2406.10163","citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:09a6b0ce63c88fe721609924a13973d3e2f37efbde40f26cf51e03c902c55524","observation_id":"c1a60997-0855-4c15-a47b-f26edd986137","resolution":{"observed_at":"2026-08-12T20:31:45.737129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02555","last_updated":"2024-12-01T14:34:01Z","snapshot_observed_at":"2026-08-16T13:28:26.714936Z","submitted_at":"2024-08-05T15:33:45Z","title":"MeshAnything V2: Artist-Created Mesh Generation With Adjacent Mesh Tokenization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02555","snapshot_observed_at":"2026-08-12T20:31:45.741231Z","title":"Meshany- thing v2: Artist-created mesh generation with adjacent mesh tokenization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.741231Z"},"links":{"cited_paper":"/paper/2408.02555","citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:6350c44e1720fe65ce3d868ea9a01b1efc9e2b8cbb1a406b8eb7cf4b91042142","observation_id":"12712618-24d6-46a4-af98-ffe3c861644f","resolution":{"observed_at":"2026-08-12T20:31:45.741231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16585","last_updated":"2024-04-02T05:10:02Z","snapshot_observed_at":"2026-08-19T22:18:38.052508Z","submitted_at":"2023-09-28T16:44:31Z","title":"Text-to-3D using Gaussian Splatting","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16585","snapshot_observed_at":"2026-08-12T20:31:45.745582Z","title":"Text-to-3d using gaussian splatting","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.745582Z"},"links":{"cited_paper":"/paper/2309.16585","citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:696999d7ef960cc7c61dfe4110a2d8fe37efca3871cee8b40cf024ddcfc47c59","observation_id":"499a3706-0b2c-44c3-b2e6-55c606cff6ed","resolution":{"observed_at":"2026-08-12T20:31:45.745582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:31:45.749661Z","title":"Internvl: Scaling up vision foundation mod- els and aligning for generic visual-linguistic tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.749661Z"},"links":{"citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:55a7826285ce48da725ffda5430d0794491dae9838fc044b84f3e259be87f63b","observation_id":"88ec9b23-3874-4f45-8215-5de705d428e9","resolution":{"observed_at":"2026-08-12T20:31:45.749661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-12T20:31:45.753003Z","title":"Train- ing verifiers to solve math word problems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.753003Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:c37eef24af7e9310a74d7124276b730a2ea59da8cf3dcf493f897195a7c8e2ca","observation_id":"655c0ddd-2ad2-45de-932b-e902a6a62042","resolution":{"observed_at":"2026-08-12T20:31:45.753003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:31:46.841427Z","title":"Objaverse: A universe of annotated 3d objects","venue":null,"work_id":"4322bc2f-6b74-48d4-bcdc-b922a714f7c9","year":2023},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.756433Z"},"links":{"citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:3b14cd4ecd2536084ac4a0b5467b9ee3702e4d97872a0badaae7f663182c574b","observation_id":"3783d654-70db-465a-b138-13754956b09b","resolution":{"observed_at":"2026-08-12T20:31:46.845203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14233","last_updated":"2023-05-23T16:49:14Z","snapshot_observed_at":"2026-08-18T05:06:04.678949Z","submitted_at":"2023-05-23T16:49:14Z","title":"Enhancing Chat Language Models by Scaling High-quality Instructional Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14233","snapshot_observed_at":"2026-08-12T20:31:45.759638Z","title":"Enhancing chat language models by scal- ing high-quality instructional conversations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.759638Z"},"links":{"cited_paper":"/paper/2305.14233","citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:d51393147dfe8f028cfb2aa552eb2f98eb050b883ae23d48e480f9f842abed2d","observation_id":"c1298562-b580-47f8-a37e-7fe330d4c7b2","resolution":{"observed_at":"2026-08-12T20:31:45.759638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-12T20:31:45.763070Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.763070Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:fd1b547fd056e04b9448248a13e0b44e756b084ce806ee1e70089953188ccb5b","observation_id":"1c4d7273-c100-40f6-819e-872bec5b6801","resolution":{"observed_at":"2026-08-12T20:31:45.763070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:31:45.767187Z","title":"Taming transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.767187Z"},"links":{"citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:be39b1565c87cb6a3e4a00fd7fa876ce592df869471db39cec85cff92fc9b269","observation_id":"98932d2d-4a9b-4c24-a735-6fc1e1fa937f","resolution":{"observed_at":"2026-08-12T20:31:45.767187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-13T20:44:28.824685Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-12T20:31:45.771252Z","title":"Mea- suring massive multitask language understanding","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.771252Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:5c0a4886bdf56b182ce15c0744b6f408b6dcc2437affe9431ca9b39c4bc46130","observation_id":"443763fe-f141-4ed7-a574-b0b4204657d9","resolution":{"observed_at":"2026-08-12T20:31:45.771252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04400","last_updated":"2024-03-09T10:47:51Z","snapshot_observed_at":"2026-08-18T01:50:26.644460Z","submitted_at":"2023-11-08T00:03:52Z","title":"LRM: Large Reconstruction Model for Single Image to 3D","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.04400","snapshot_observed_at":"2026-08-12T20:31:45.775111Z","title":"Lrm: Large reconstruction model for single image to 3d","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.775111Z"},"links":{"cited_paper":"/paper/2311.04400","citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:8d0e8aad825d1e0b7112d70cd4420edbfb37938ce37b556798e239d49851a370","observation_id":"e27dda7e-1ff8-466f-85e1-15b81713d7a5","resolution":{"observed_at":"2026-08-12T20:31:45.775111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:31:46.822147Z","title":"Collaborative score distilla- tion for consistent visual synthesis, 2023","venue":null,"work_id":"a2537728-0b21-4998-b8d7-0f042498fc19","year":2023},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.779082Z"},"links":{"citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:9172384b275b295f2ac7fc78b0f7e8ffed2615014101ab6871bd39370739170e","observation_id":"16c31984-01da-4268-afc9-cd28e7ff72d1","resolution":{"observed_at":"2026-08-12T20:31:46.826700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:31:45.782844Z","title":"Blip: Bootstrapping language-image pre-training for unified vision-language understanding and generation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.782844Z"},"links":{"citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:cb71642fa46019dab94dbbdfc463628965910dec9b7671fd5a9b9c99d764acbb","observation_id":"229884ab-f6e3-4ab4-9a81-dfe2e1b57847","resolution":{"observed_at":"2026-08-12T20:31:45.782844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:31:45.786391Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.786391Z"},"links":{"citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:bd09e12b60d761f87e45d595c8e2ff7fd42b85907669a58ba76978c196d1d1d1","observation_id":"a1f66a83-b030-43d9-8bf7-fe47ccb833e7","resolution":{"observed_at":"2026-08-12T20:31:45.786391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.06214","last_updated":"2023-11-23T08:55:49Z","snapshot_observed_at":"2026-08-17T23:12:45.651347Z","submitted_at":"2023-11-10T18:03:44Z","title":"Instant3D: Fast Text-to-3D with Sparse-View Generation and Large Reconstruction Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.06214","snapshot_observed_at":"2026-08-12T20:31:45.789867Z","title":"Instant3d: Fast text-to-3d with sparse-view generation and large reconstruction model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.789867Z"},"links":{"cited_paper":"/paper/2311.06214","citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:38ad04019aaaea689562ebb85d564d9f0200a8978b104788ffa6491300d2aebf","observation_id":"26389b81-bb88-47d2-9ead-bebcac521104","resolution":{"observed_at":"2026-08-12T20:31:45.789867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14979","last_updated":"2025-05-30T10:22:03Z","snapshot_observed_at":"2026-08-18T08:57:56.967308Z","submitted_at":"2024-05-23T18:30:12Z","title":"CraftsMan3D: High-fidelity Mesh Generation with 3D Native Generation and Interactive Geometry Refiner","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14979","snapshot_observed_at":"2026-08-12T20:31:45.793314Z","title":"Craftsman: High-fidelity 9 mesh generation with 3d native generation and interactive geometry refiner","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.793314Z"},"links":{"cited_paper":"/paper/2405.14979","citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:07064f6a249bc41ff84bc41eb44b701ea151d8b06092a323307e342b914b6c79","observation_id":"ba0348b1-2d3e-4c52-8781-5f2141b32ee7","resolution":{"observed_at":"2026-08-12T20:31:45.793314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:31:45.797089Z","title":"Luciddreamer: Towards high-fidelity text-to-3d generation via interval score match- ing, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.797089Z"},"links":{"citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:d22df5b7668ec0ed48b2f6125de0eb09bafcda756155688a38df09f36e635d64","observation_id":"217972b8-76dd-4025-8e4c-c1ccc7c56dfa","resolution":{"observed_at":"2026-08-12T20:31:45.797089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.09788","last_updated":"2024-09-15T16:45:42Z","snapshot_observed_at":"2026-08-20T01:58:32.170098Z","submitted_at":"2024-09-15T16:45:42Z","title":"Reasoning Paths with Reference Objects Elicit Quantitative Spatial Reasoning in Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.09788","snapshot_observed_at":"2026-08-12T20:31:45.800492Z","title":"Reasoning paths with reference objects elicit quan- titative spatial reasoning in large vision-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.800492Z"},"links":{"cited_paper":"/paper/2409.09788","citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:a0ea6d15cbbe4c611f71a87d12fe10c31458ccbbbccf2e60b58297be5b2386c3","observation_id":"5b7c4d5f-a772-407d-8a93-7eaf9bad5ea7","resolution":{"observed_at":"2026-08-12T20:31:45.800492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:31:45.803888Z","title":"Magic3d: High-resolution text-to-3d content creation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.803888Z"},"links":{"citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:38197ef2afa4da8afed04f4dcb5a7d93c81394b0b67408c17ca5b387a5f363b8","observation_id":"08b2a8d2-9e0b-42d0-ac3f-517bbf7607b7","resolution":{"observed_at":"2026-08-12T20:31:45.803888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:31:45.807197Z","title":"Vila: On pre-training for vi- sual language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.807197Z"},"links":{"citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:18651cab4b6c94f293b3365a703dba3189542ec78fd6c761d48b52c6b249a8e7","observation_id":"31ff1c82-cd76-4729-b7c5-20429cb94e11","resolution":{"observed_at":"2026-08-12T20:31:45.807197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:31:46.764489Z","title":"Sherpa3d: Boosting high-fidelity text-to-3d genera- tion via coarse 3d prior, 2023","venue":null,"work_id":"2ebac30d-efcb-4a32-aeb2-ab9292fa3f23","year":2023},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.810304Z"},"links":{"citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:2f567fafd5b2d210b24b289a3b666c3fbef5c290947f5929328287a01b243b5d","observation_id":"09d80f41-2198-47fe-83b5-d2281bfc789e","resolution":{"observed_at":"2026-08-12T20:31:46.768888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:31:45.813961Z","title":"Visual instruction tuning, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.813961Z"},"links":{"citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:f48860850d6c1adf1bd36e7c00b857d28a7db4bb26be1bc793965f95a255edc9","observation_id":"9892cb41-a509-43dc-81fc-665bff7d7d39","resolution":{"observed_at":"2026-08-12T20:31:45.813961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:31:45.817461Z","title":"Improved baselines with visual instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.817461Z"},"links":{"citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:2052da22837ab13121cbfa96f727dd6f216af33eb3d3ff353ea4e28a92601cc0","observation_id":"7469215e-3410-43ec-a9c8-6efa4e8245e3","resolution":{"observed_at":"2026-08-12T20:31:45.817461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:31:45.821252Z","title":"Visual instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.821252Z"},"links":{"citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:7d6fde8e5a98d56f6bd0e1817889da125ab0feccd779434ba7e4605bd5883225","observation_id":"14f424da-79c1-45c0-bbf4-3e5a59566619","resolution":{"observed_at":"2026-08-12T20:31:45.821252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07885","last_updated":"2023-11-14T03:40:25Z","snapshot_observed_at":"2026-08-16T14:43:34.252049Z","submitted_at":"2023-11-14T03:40:25Z","title":"One-2-3-45++: Fast Single Image to 3D Objects with Consistent Multi-View Generation and 3D Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07885","snapshot_observed_at":"2026-08-12T20:31:45.825556Z","title":"One-2-3-45++: Fast single image to 3d objects with consistent multi-view generation and 3d diffusion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.825556Z"},"links":{"cited_paper":"/paper/2311.07885","citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:86bcc61971d6ea0afcdb3d58b27b922038295a739e7de0a0fbf133f944469315","observation_id":"75ffd1c9-e0c2-4b9b-8c7d-37815c0bb425","resolution":{"observed_at":"2026-08-12T20:31:45.825556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.16928","last_updated":"2023-06-29T13:28:16Z","snapshot_observed_at":"2026-08-16T15:20:03.825980Z","submitted_at":"2023-06-29T13:28:16Z","title":"One-2-3-45: Any Single Image to 3D Mesh in 45 Seconds without Per-Shape Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.16928","snapshot_observed_at":"2026-08-12T20:31:45.830844Z","title":"One-2-3-45: Any single image to 3d mesh in 45 seconds without per-shape optimization.arXiv preprint arXiv:2306.16928, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.830844Z"},"links":{"cited_paper":"/paper/2306.16928","citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:b9f73cc9d560ba134313ae32decfd22f72c5c7ead186fc925da06ba31e9458a8","observation_id":"c8e386f3-903c-4f96-95ce-2e0d5ee38499","resolution":{"observed_at":"2026-08-12T20:31:45.830844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:31:46.732373Z","title":"Att3d: Amortized text-to-3d object synthesis, 2023","venue":null,"work_id":"105e558c-d506-4f1f-8249-0c795ba67b22","year":2023},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.834824Z"},"links":{"citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:36def962f29534f48b8da836ebb08885615e34c27a015291771e6138f00edf51","observation_id":"812776f4-4fde-45c9-870c-d9894887600d","resolution":{"observed_at":"2026-08-12T20:31:46.735832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-12T20:31:45.838802Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.838802Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:a193c6869b516b9f13d4d294a4f0224ba7c0e40679d27312b7f78ed4f3713bc8","observation_id":"49f4b9a6-30b8-43f0-aae2-bb656e8d9495","resolution":{"observed_at":"2026-08-12T20:31:45.838802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09842","last_updated":"2023-10-31T17:43:39Z","snapshot_observed_at":"2026-08-18T03:05:32.170128Z","submitted_at":"2023-04-19T17:47:47Z","title":"Chameleon: Plug-and-Play Compositional Reasoning with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.09842","snapshot_observed_at":"2026-08-12T20:31:45.843384Z","title":"Chameleon: Plug-and-play compositional reason- ing with large language models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.843384Z"},"links":{"cited_paper":"/paper/2304.09842","citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:06f55e00b12a4a5f0bd132fd8b525db4e8da950fcfeb506d1c066dddee38b688","observation_id":"fd84c4b2-4181-4e37-ae31-abdee3e8396a","resolution":{"observed_at":"2026-08-12T20:31:45.843384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:31:45.852285Z","title":"Scalable 3d captioning with pretrained models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.852285Z"},"links":{"citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:fc51de744252f86631715133f5d021b289fcfb01d1e46feeb15255868e9e6794","observation_id":"fc72a359-dd23-42ba-bff1-0f6fcbe96110","resolution":{"observed_at":"2026-08-12T20:31:45.852285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:31:45.855833Z","title":"Polygen: An autoregressive generative model of 3d meshes","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.855833Z"},"links":{"citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:3a343569ae25c0415dc601c3f978c72c7e7700beca129d04250f26d16b570241","observation_id":"1b0be72d-7642-4818-9e78-9d7d2d6518e3","resolution":{"observed_at":"2026-08-12T20:31:45.855833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:31:46.704632Z","title":"Sdxl: Improving latent diffusion models for high-resolution image synthesis, 2023","venue":null,"work_id":"917afcff-b9c0-4f6c-b4ea-86c017f76ab6","year":2023},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.859996Z"},"links":{"citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:cb360e69017d68be6ff663d2a753ea5bbad37403861f3a5bb1e640f7bc1f165c","observation_id":"1066dcb0-b9bd-4194-9131-26643fcd7096","resolution":{"observed_at":"2026-08-12T20:31:46.708738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14988","last_updated":"2022-09-29T17:50:40Z","snapshot_observed_at":"2026-07-06T13:57:54.539656Z","submitted_at":"2022-09-29T17:50:40Z","title":"DreamFusion: Text-to-3D using 2D Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14988","snapshot_observed_at":"2026-08-12T20:31:45.864067Z","title":"Dreamfusion: Text-to-3d using 2d diffusion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.864067Z"},"links":{"cited_paper":"/paper/2209.14988","citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:762b34883297605060e52cd22a9d2687ff6159e1fe05bcd3bc1ae1f5ef64ad64","observation_id":"0e54dd0c-7e0e-4d03-87b4-320f2a85c76d","resolution":{"observed_at":"2026-08-12T20:31:45.864067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:31:45.870127Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.870127Z"},"links":{"citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:4d443831219285421722204aaaa4fbce4721194ac5fd98bb4191a041b19cf8cf","observation_id":"56196054-7b46-4f62-90ca-84b13d3b2fb7","resolution":{"observed_at":"2026-08-12T20:31:45.870127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:31:45.874261Z","title":"Photorealistic text-to-image diffusion models with deep language understanding","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.874261Z"},"links":{"citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:5f337ab19710c2159af095624127ebe76046788e138dfc696d39536b6244dc18","observation_id":"c3fabf2a-fbc5-4cf8-81d6-352fd38ca168","resolution":{"observed_at":"2026-08-12T20:31:45.874261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:31:45.878719Z","title":"Deep marching tetrahedra: a hybrid repre- sentation for high-resolution 3d shape synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.878719Z"},"links":{"citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:52b2c3195e9542f7f9af1fe2635538155a35aaa4ae2f48df41550950cb54ca91","observation_id":"a7fb4615-cea9-4abc-8087-82d7fcb9df3d","resolution":{"observed_at":"2026-08-12T20:31:45.878719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:31:46.672931Z","title":"Flexible isosurface extraction for gradient-based mesh optimization","venue":null,"work_id":"84e4dafb-4ad0-4e69-8a3c-4e7462486c39","year":2023},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.883100Z"},"links":{"citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:fe20a262874eebb75643a997141bfc28463dc6570646432baa662ccdfc18d8df","observation_id":"2969a9e3-5ffe-4693-ac0d-adba7cf9ea7e","resolution":{"observed_at":"2026-08-12T20:31:46.676113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:31:46.662175Z","title":"Meshgpt: Generating triangle meshes with decoder-only transformers","venue":null,"work_id":"e1705206-c1eb-4c16-a7d6-dffdc4c8f501","year":2024},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.887594Z"},"links":{"citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:4c978f53c65e064cda04ab4195494b985af2cda175d845f287dd9caabc1b6857","observation_id":"006a04f4-3d5c-4bdd-b7b8-f372f39dca9a","resolution":{"observed_at":"2026-08-12T20:31:46.666189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:31:46.650363Z","title":"Dreamcraft3d: Hierarchical 3d generation with bootstrapped diffusion prior, 2023","venue":null,"work_id":"b4baba7c-4751-404a-99b0-0d7d3394b144","year":2023},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.891750Z"},"links":{"citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:95f45d4a90cf596ec167ca4a88e69cb6d0aa2f29af7e7cdc24a441a3708639bd","observation_id":"a31cc5be-fb4b-44cb-b0e5-3ab6336f728d","resolution":{"observed_at":"2026-08-12T20:31:46.654702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16653","last_updated":"2024-03-29T08:39:23Z","snapshot_observed_at":"2026-07-06T16:25:05.493379Z","submitted_at":"2023-09-28T17:55:05Z","title":"DreamGaussian: Generative Gaussian Splatting for Efficient 3D Content Creation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16653","snapshot_observed_at":"2026-08-12T20:31:45.896378Z","title":"Dreamgaussian: Generative gaussian splatting for effi- cient 3d content creation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.896378Z"},"links":{"cited_paper":"/paper/2309.16653","citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:130d95ac05c15e6a2ff3a2b500413edec7b5480599d3a33a6c8c03325017f03d","observation_id":"5d67ef2b-f3a2-4714-87d1-c49f0e7447b0","resolution":{"observed_at":"2026-08-12T20:31:45.896378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:31:45.901466Z","title":"Lgm: Large multi-view gaussian model for high-resolution 3d content creation, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.901466Z"},"links":{"citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:4162ae1cb6957ce8fecea77004fbf4884fcb4b9c9005e1cfe968a15e44a07158","observation_id":"66752694-f575-4dab-a9de-689b026a0552","resolution":{"observed_at":"2026-08-12T20:31:45.901466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18114","last_updated":"2024-09-26T17:55:02Z","snapshot_observed_at":"2026-08-20T14:30:17.342310Z","submitted_at":"2024-09-26T17:55:02Z","title":"EdgeRunner: Auto-regressive Auto-encoder for Artistic Mesh Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18114","snapshot_observed_at":"2026-08-12T20:31:45.906267Z","title":"Edgerunner: Auto-regressive auto-encoder for artistic mesh generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.906267Z"},"links":{"cited_paper":"/paper/2409.18114","citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:5dc7cf2e91cfef350d5a1473cdf11e59224f5929d9805e097c408c87897a4e7f","observation_id":"78161074-05cc-4139-8a1a-719112b24537","resolution":{"observed_at":"2026-08-12T20:31:45.906267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:31:45.911872Z","title":"Neural discrete representation learning,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.911872Z"},"links":{"citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:cc5f45b8d8bfef172b62965f381f6a530a588e5bb84337cde46cfc4ea5e0259d","observation_id":"5ca30954-75e3-4324-a4b1-c27a80314a57","resolution":{"observed_at":"2026-08-12T20:31:45.911872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:31:46.623322Z","title":"Gomez, Lukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":"95aeb579-5887-43ca-9093-6fab945a9977","year":2023},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.915469Z"},"links":{"citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:9ee5e07e60197f824adc93c7e0160923deb807f2c0da757528b7b51f33599726","observation_id":"74bbf6d1-1787-47c8-9d8b-9b216edcb66a","resolution":{"observed_at":"2026-08-12T20:31:46.627427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12024","last_updated":"2023-11-23T17:59:42Z","snapshot_observed_at":"2026-08-16T14:41:45.064723Z","submitted_at":"2023-11-20T18:57:55Z","title":"PF-LRM: Pose-Free Large Reconstruction Model for Joint Pose and Shape Prediction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12024","snapshot_observed_at":"2026-08-12T20:31:45.918695Z","title":"Pf-lrm: Pose-free large reconstruction model for joint pose and shape prediction","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.918695Z"},"links":{"cited_paper":"/paper/2311.12024","citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:9e1d59c21c0987cde310176a06c75a598762cbe36f4e824aef7b765efdd7ccb1","observation_id":"3a315881-886e-4c74-b717-10713557ccb4","resolution":{"observed_at":"2026-08-12T20:31:45.918695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:31:46.612578Z","title":"Animatabledreamer: Text-guided non- rigid 3d model generation and reconstruction with canonical score distillation, 2023","venue":null,"work_id":"c9b32e79-6da9-4dfe-9847-3e5ca16c0229","year":2023},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.923011Z"},"links":{"citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:6d0492a88c773fd82ed6ba6af08c3f288fd703360021451a87304f0fd0dbb254","observation_id":"3b6244b6-c32a-4102-855d-2de9d10cf809","resolution":{"observed_at":"2026-08-12T20:31:46.615955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18869","last_updated":"2024-09-27T16:06:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-27T16:06:11Z","title":"Emu3: Next-Token Prediction is All You Need","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18869","snapshot_observed_at":"2026-08-12T20:31:45.926291Z","title":"Emu3: Next-token prediction is all you need","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.926291Z"},"links":{"cited_paper":"/paper/2409.18869","citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:223e495618242e6e8b6b2431f38f5ef909e33503af7c14f2c8271ffadbc9261b","observation_id":"db8f5be4-fe07-485d-9af5-ac0073aaa0f8","resolution":{"observed_at":"2026-08-12T20:31:45.926291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:31:46.602439Z","title":"Prolificdreamer: High-fidelity and diverse text-to-3d generation with variational score distilla- tion","venue":null,"work_id":"5900d0aa-8b8a-4af8-921e-527afbf7a6c1","year":2023},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.930200Z"},"links":{"citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:7aa15284035835934c3ffaacc9ad1722b87d1c72daf93ca76b0675715ef4ee28","observation_id":"ca0f3f0e-a989-44e2-be39-93dc0cba51c7","resolution":{"observed_at":"2026-08-12T20:31:46.605976Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05034","last_updated":"2024-03-08T04:25:29Z","snapshot_observed_at":"2026-08-16T14:11:45.250533Z","submitted_at":"2024-03-08T04:25:29Z","title":"CRM: Single Image to 3D Textured Mesh with Convolutional Reconstruction Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05034","snapshot_observed_at":"2026-08-12T20:31:45.933630Z","title":"Crm: Single image to 3d textured mesh with convolutional reconstruction model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.933630Z"},"links":{"cited_paper":"/paper/2403.05034","citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:ad48e388f6a15e639eccb6e9443d282c1829bc62b53ab683af344c8cf0612276","observation_id":"cf4f9175-8c30-4828-a1af-5b6be4b9976c","resolution":{"observed_at":"2026-08-12T20:31:45.933630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16890","last_updated":"2024-05-27T07:13:13Z","snapshot_observed_at":"2026-08-20T15:09:20.841209Z","submitted_at":"2024-05-27T07:13:13Z","title":"PivotMesh: Generic 3D Mesh Generation via Pivot Vertices Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16890","snapshot_observed_at":"2026-08-12T20:31:45.937664Z","title":"Pivotmesh: Generic 3d mesh generation via pivot ver- tices guidance","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.937664Z"},"links":{"cited_paper":"/paper/2405.16890","citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:e81019b22d4ac6aad899de325b34ba399722cae260bf3f0726a5007387d41590","observation_id":"8cbe9146-6cf4-4247-b2a4-f083449bfdd9","resolution":{"observed_at":"2026-08-12T20:31:45.937664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20343","last_updated":"2024-10-28T15:41:12Z","snapshot_observed_at":"2026-08-20T23:22:37.761431Z","submitted_at":"2024-05-30T17:59:54Z","title":"Unique3D: High-Quality and Efficient 3D Mesh Generation from a Single Image","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20343","snapshot_observed_at":"2026-08-12T20:31:45.941332Z","title":"Unique3d: High-quality and efficient 3d mesh generation from a single image","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.941332Z"},"links":{"cited_paper":"/paper/2405.20343","citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:791d6d44a599db4be99b495f929b8df9e6d8ba9b06f3d167dd2954bfeb6fe0b1","observation_id":"57ab9b91-161c-4753-8ef3-4fb803d2ba21","resolution":{"observed_at":"2026-08-12T20:31:45.941332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14832","last_updated":"2024-06-01T16:18:53Z","snapshot_observed_at":"2026-08-20T13:19:09.288646Z","submitted_at":"2024-05-23T17:49:37Z","title":"Direct3D: Scalable Image-to-3D Generation via 3D Latent Diffusion Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14832","snapshot_observed_at":"2026-08-12T20:31:45.945480Z","title":"Direct3d: Scalable image-to-3d generation via 3d latent diffusion transformer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.945480Z"},"links":{"cited_paper":"/paper/2405.14832","citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:e8550b9e3d7b96bf9417c0f11cf725855ba3b105d9b72e266cf35506013822c4","observation_id":"07411c6c-4fcc-4aa0-a30a-c9824ce56163","resolution":{"observed_at":"2026-08-12T20:31:45.945480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04429","last_updated":"2025-03-04T16:31:57Z","snapshot_observed_at":"2026-08-01T23:38:04.510222Z","submitted_at":"2024-09-06T17:49:56Z","title":"VILA-U: a Unified Foundation Model Integrating Visual Understanding and Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04429","snapshot_observed_at":"2026-08-12T20:31:45.951007Z","title":"Vila-u: a unified foundation model inte- grating visual understanding and generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.951007Z"},"links":{"cited_paper":"/paper/2409.04429","citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:0f13080d99a3075e7884bbf0f47e5736e8fc28ff6c71433cb07ec4fdee0553b4","observation_id":"61212746-ff3b-47ca-bb63-637b9561d24f","resolution":{"observed_at":"2026-08-12T20:31:45.951007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12528","last_updated":"2025-09-08T02:42:57Z","snapshot_observed_at":"2026-08-18T17:34:44.890427Z","submitted_at":"2024-08-22T16:32:32Z","title":"Show-o: One Single Transformer to Unify Multimodal Understanding and Generation","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12528","snapshot_observed_at":"2026-08-12T20:31:45.955544Z","title":"Show-o: One single transformer to unify multimodal understanding and generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.955544Z"},"links":{"cited_paper":"/paper/2408.12528","citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:660f869255649c6f60d17aab40d65218974009a43c407d0ff1c3d1ede4e719da","observation_id":"072bbd02-3f23-4607-a47c-51a05ff87dc5","resolution":{"observed_at":"2026-08-12T20:31:45.955544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.15385","last_updated":"2024-03-22T17:59:37Z","snapshot_observed_at":"2026-08-16T14:07:14.959127Z","submitted_at":"2024-03-22T17:59:37Z","title":"LATTE3D: Large-scale Amortized Text-To-Enhanced3D Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.15385","snapshot_observed_at":"2026-08-12T20:31:45.959279Z","title":"Latte3d: Large-scale amortized text-to-enhanced3d synthe- sis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.959279Z"},"links":{"cited_paper":"/paper/2403.15385","citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:6091d437ee33cb5fa4ee4bd37fd76d4d36ccea86930bbd5d5b6f9df752e4b811","observation_id":"7e105978-8744-4701-bb30-0da15170d27f","resolution":{"observed_at":"2026-08-12T20:31:45.959279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07191","last_updated":"2024-04-14T16:54:24Z","snapshot_observed_at":"2026-08-13T18:57:44.379289Z","submitted_at":"2024-04-10T17:48:37Z","title":"InstantMesh: Efficient 3D Mesh Generation from a Single Image with Sparse-view Large Reconstruction Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07191","snapshot_observed_at":"2026-08-12T20:31:45.963369Z","title":"Instantmesh: Efficient 3d mesh generation from a single image with sparse-view large reconstruction models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.963369Z"},"links":{"cited_paper":"/paper/2404.07191","citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:072a3872c7425052134c3bd31972198478475211b812f5bd171a2bd425aea5f1","observation_id":"63c48389-88a0-4661-85a3-aee8e24e9f5c","resolution":{"observed_at":"2026-08-12T20:31:45.963369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.09217","last_updated":"2023-11-15T18:58:41Z","snapshot_observed_at":"2026-08-20T10:20:54.525536Z","submitted_at":"2023-11-15T18:58:41Z","title":"DMV3D: Denoising Multi-View Diffusion using 3D Large Reconstruction Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.09217","snapshot_observed_at":"2026-08-12T20:31:45.966825Z","title":"Dmv3d: Denoising multi-view diffu- sion using 3d large reconstruction model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.966825Z"},"links":{"cited_paper":"/paper/2311.09217","citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:0e0ca80de3f1c3f43c534fdb8462a3c1e38227cc04f980c4e95baf74bb49b1ee","observation_id":"d7f07a68-523e-406e-a1b0-c01ac2e65bda","resolution":{"observed_at":"2026-08-12T20:31:45.966825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:31:46.587175Z","title":"Holodeck: Language guided gen- eration of 3d embodied ai environments","venue":null,"work_id":"df2476b8-2d96-4ec0-95ff-d8f5d1de3472","year":2024},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.970959Z"},"links":{"citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:60868602338a5b4b9ad1c9c44a0f40313682844274eca62e2b99bc8c6922f3d9","observation_id":"892815cc-ec1e-4b77-bb22-023305fdc067","resolution":{"observed_at":"2026-08-12T20:31:46.590813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14178","last_updated":"2024-03-29T08:13:38Z","snapshot_observed_at":"2026-08-16T17:13:28.893408Z","submitted_at":"2023-04-27T13:27:01Z","title":"mPLUG-Owl: Modularization Empowers Large Language Models with Multimodality","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14178","snapshot_observed_at":"2026-08-12T20:31:45.974690Z","title":"mplug-owl: Modularization empowers large language models with multimodality","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.974690Z"},"links":{"cited_paper":"/paper/2304.14178","citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:a9f6bbad77f46777de6519acc71a3dc1da730a249d341f28da52c0daa4670351","observation_id":"af8548f4-411a-4edc-bc33-8b4fc671c664","resolution":{"observed_at":"2026-08-12T20:31:45.974690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:31:46.573053Z","title":"Spae: Semantic pyramid autoencoder for multimodal generation with frozen llms","venue":null,"work_id":"e7051d27-07ff-428a-89a9-0a4798b4f7be","year":2024},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.978702Z"},"links":{"citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:c8b52aa879161bb3706596bd1744f7c174935233f9621dd559a4722ae0e4d152","observation_id":"d7462a47-88a0-40d9-8695-604d4dc9c399","resolution":{"observed_at":"2026-08-12T20:31:46.579130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:31:45.982481Z","title":"Text-to-3d with classifier score distillation, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.982481Z"},"links":{"citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:53b30f9d772acbba605f1b88dead3a93fd8ec39b77ba87020c6e52c579bbc099","observation_id":"a28d6751-d33e-4dbf-81f7-87b09ced2e36","resolution":{"observed_at":"2026-08-12T20:31:45.982481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.07830","last_updated":"2019-05-19T23:57:23Z","snapshot_observed_at":"2026-08-15T09:37:44.321271Z","submitted_at":"2019-05-19T23:57:23Z","title":"HellaSwag: Can a Machine Really Finish Your Sentence?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.07830","snapshot_observed_at":"2026-08-12T20:31:45.986012Z","title":"Hellaswag: Can a machine really finish your sentence? arXiv preprint arXiv:1905.07830, 2019","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.986012Z"},"links":{"cited_paper":"/paper/1905.07830","citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:de9ba8d6fcb4b040f62497780272ccccfde53b3649409c763959faafcfb6c833","observation_id":"854ebd89-93cf-4980-8b3c-3dba926a854b","resolution":{"observed_at":"2026-08-12T20:31:45.986012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:31:45.990233Z","title":"Clay: A controllable large-scale generative model for creat- ing high-quality 3d assets","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.990233Z"},"links":{"citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:4a7e283db37e3df044a08fe26b4434e8d36274cafe526158e47721ac8d4d8c52","observation_id":"d67328ea-0159-41a6-b01d-2eafbb70a7fa","resolution":{"observed_at":"2026-08-12T20:31:45.990233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15112","last_updated":"2023-12-14T17:21:39Z","snapshot_observed_at":"2026-08-21T19:15:22.406940Z","submitted_at":"2023-09-26T17:58:20Z","title":"InternLM-XComposer: A Vision-Language Large Model for Advanced Text-image Comprehension and Composition","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15112","snapshot_observed_at":"2026-08-12T20:31:45.994036Z","title":"Internlm- xcomposer: A vision-language large model for advanced text-image comprehension and composition","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.994036Z"},"links":{"cited_paper":"/paper/2309.15112","citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:85e453d8252e333ce44ca8807e1d12bc29a9af0379a9cd919a19825dc9d45c15","observation_id":"fbdfb86d-d905-4e2c-94aa-90570d125bab","resolution":{"observed_at":"2026-08-12T20:31:45.994036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.16770","last_updated":"2025-03-29T19:17:13Z","snapshot_observed_at":"2026-08-16T13:07:06.117700Z","submitted_at":"2024-10-22T07:40:20Z","title":"The Scene Language: Representing Scenes with Programs, Words, and Embeddings","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.16770","snapshot_observed_at":"2026-08-12T20:31:45.997929Z","title":"The scene language: Representing scenes with programs, words, and embeddings","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:45.997929Z"},"links":{"cited_paper":"/paper/2410.16770","citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:9ea7dccf8eb3ee1bb3a0b8c32bae851cb789c750ab42330be05796b959abb03f","observation_id":"8fc45b71-01dc-46e9-b4c4-13c8b6546e15","resolution":{"observed_at":"2026-08-12T20:31:45.997929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11039","last_updated":"2024-08-20T17:48:20Z","snapshot_observed_at":"2026-08-19T12:50:53.888784Z","submitted_at":"2024-08-20T17:48:20Z","title":"Transfusion: Predict the Next Token and Diffuse Images with One Multi-Modal Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.11039","snapshot_observed_at":"2026-08-12T20:31:46.001684Z","title":"Transfusion: Pre- dict the next token and diffuse images with one multi-modal model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:46.001684Z"},"links":{"cited_paper":"/paper/2408.11039","citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:0627783aa0dc7309920bbd40752227d701c63cb189d70e131a966d1994a672ad","observation_id":"d7e80483-bc69-4086-a013-c53ff6c58f8e","resolution":{"observed_at":"2026-08-12T20:31:46.001684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:31:46.005440Z","title":"Hifa: High-fidelity text-to-3d generation with advanced diffusion guidance, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:46.005440Z"},"links":{"citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:add93fef92bcf44240f514672b368096e55d5a7857768d6313d97494fde2d83e","observation_id":"41de6e27-5e0d-42ac-97fd-22ea6142f074","resolution":{"observed_at":"2026-08-12T20:31:46.005440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09147","last_updated":"2023-12-16T04:31:20Z","snapshot_observed_at":"2026-08-16T14:34:41.058005Z","submitted_at":"2023-12-14T17:18:34Z","title":"Triplane Meets Gaussian Splatting: Fast and Generalizable Single-View 3D Reconstruction with Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09147","snapshot_observed_at":"2026-08-12T20:31:46.008638Z","title":"Triplane meets gaussian splatting: Fast and generalizable single- view 3d reconstruction with transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-12T20:31:46.008638Z"},"links":{"cited_paper":"/paper/2312.09147","citing_paper":"/paper/2411.09595"},"observation_digest":"sha256:c46c22bdf21f4ec24afc8b4be15fdcc28be02d908588e3789696b7da99a0ecde","observation_id":"d13e99d8-db80-4222-9fc8-eab50aa2070d","resolution":{"observed_at":"2026-08-12T20:31:46.008638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2411.09595","last_updated":"2024-11-14T17:08:23Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-15T11:56:54.927856Z","submitted_at":"2024-11-14T17:08:23Z","title":"LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models"},"reference_resolution":{"displayed":76,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":62,"verified_exact":0,"verified_fuzzy":14},"total_outbound_references":76},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 76 of 76 outbound references and 40 inbound Pith citation observations for arXiv:2411.09595."}