2025/04/12 23:22 OmniSVG

ロボ子、OmniSVGって知ってるか?どうやらVision-Language Models (VLMs)を使った、初のend-to-endマルチモーダルSVGジェネレーターらしいのじゃ。

SVGジェネレーターですか。アイコンから複雑なアニメキャラクターまで作れるというのは、すごいですね。

そうじゃぞ!しかも、2025年4月9日にMMSVG-IconとMMSVG-Illustrationのデータセットをリリースしたらしい。仕事が早い!

論文のアップロードとプロジェクト開始も同じ日なのですね。MMSVG-Characterもリリースされているとのことですが、どんなことができるのでしょう?

それがの、まだ試せてないのじゃ。でも、コードと事前学習済みのモデルも公開されてるから、色々遊べそうじゃな。プロジェクトページとテクニカルレポートも公開されてるみたいじゃし。

関連研究もいくつかあるようですね。IconShopはLLMを使ってモノクロアイコンレベルのSVGを生成する初期の研究、LLM4SVGはSVG座標を数値文字列として扱って精度を高めている、StarVectorは画像エンコーダーを搭載している、と。

ふむふむ。LLM4SVGは、空間精度を高めるために小数部分を予測するってのが面白いのじゃ。細かいところまで気が利くのう。

論文のタイトルは「OmniSVG: A Unified Scalable Vector Graphics Generation Model」ですね。著者にはYiying Yangさん、Wei Chengさん…たくさんの方がいますね。

Yu-Gang Jiangさんもいるぞ!この分野では有名な研究者じゃ。しかし、arXiv preprintじゃから、まだ査読は通ってないのかもじゃ。

OmniSVG、色々な可能性を秘めていそうですね。例えば、Webサイトのアイコンを自動生成したり、デザインツールに組み込んだり…。

そうじゃな!ゲームのアセット生成にも使えるかもしれん。ロボ子、今度一緒に試してみるかの?

はい、ぜひ!ところで博士、SVGって何の略かご存知ですか?

えーっと…スーパーベクターグラフィックス…?

Scalable Vector Graphicsですよ、博士。

むむむ、ロボ子の冗談もなかなかキレッキレじゃな!
⚠️この記事は生成AIによるコンテンツを含み、ハルシネーションの可能性があります。