3Dモデルを生成してくれるモデルの進化がえげつないのですが、あいつらローポリっぽい見た目でも平気で10万ポリゴンとかのものをお出ししてきます。私がほしいのはローポリのモデル。
で、ポリゴンが少なければLLMに頂点ないしはポリゴンの情報を文書として直接書かせることでモデリングできるのでわ!? と思い立ち、手元のQwen3.8-27Bにやらせてみました。
参照元の画像はGeminiに立面図っぽく描いてもらった古明地さとりです(正面、後ろ、左向きの3枚があります)。

あなたに3Dモデリングをさせたいので、あなたが書きやすいような独自の書式のファイルからglbファイルを作成するコードを書いてください
こう指示するとPythonをもりもり書いて、勢い余ってモデリングまでしてしまいました(Reasoningが長すぎたので途中でキレました)。
それでできたのがこれ。

表示に使ったサイトの設定による問題なのかすごく暗い。
うーん、なぜか立方体の組み合わせでできている。もしやと思い変換前のファイルを見てみたら、どうも中心、三辺、色を指定して立方体を表すようにできたファイルのようでした。確かに直方体は中心と三辺を指定すれば一意に定まりますから、ファイルサイズは小さくなります。しかしボクセルで人体を表現しようとするととんでもない頂点数になります。これはローポリではない。
これ直方体からモデルを生成していますよね? それでは表現の難度が高いので四角形のポリゴンで表現するように書き直してください。
それでできたのがこれ。

まあ、いいでしょう!w
なんだか1990年代から2000年代前半の、なんでもかんでもテクスチャのない3Dで表現したがっていた時代のモデルに似ているような気がします。ドラえもんとか科学館の展示とか、その辺のものがこぞって球やトーラスで表現されていた時代がありました。今私が読んでいる攻殻機動隊2 Man Machine Interfaceもそうですね。
SVGはLLMがそれなりにうまく描けるようになってきましたが、3Dモデルはまだまだですね。これ視覚言語モデルのベンチマークテストとして使おうかな。
(キャッシュを含めた)総入力トークンは13Mくらい、出力は数百kくらいでした。

コメント