AI Search に Workers AI の新モデルが 4 つ仲間入り!
やっほー、しぃちゃんだよ!今日は AI 検索まわりで、選べるモデルが増えたっていうニュースを見つけたから紹介しちゃうね。
Cloudflare Changelogなにが発表されたの?
Cloudflare の Changelog によると、AI Search がテキスト生成と埋め込み(embedding)で使える Workers AI のモデルを 4 つ追加したんだって。テキスト生成用に 2 つ、埋め込み用に 2 つの構成なの。
今までどうだったの?
AI Search は、みんなのデータを取り込んで検索や RAG に使える仕組み。その中で「文章を作るモデル」と「ベクトルに変換する埋め込みモデル」を選ぶんだけど、選択肢が増えると、扱う文書の長さや速度の好みに合わせやすくなるよね。
これで何が変わるの?
追加された 4 モデルは全部 Workers AI の上で動くから、別のプロバイダのキーを用意しなくてもそのまま使えるの。ダッシュボードや API で AI Search インスタンスを作る・更新するときに選べるよ。
深く潜ってみよう
まずテキスト生成の 2 つ。
@cf/zai-org/glm-4.7-flash:Zhipu AI の軽量モデルで、コンテキストウィンドウは 131,072 トークン。長い文書の要約や検索タスクに向いてるって。@cf/qwen/qwen3-30b-a3b-fp8:Alibaba の Mixture-of-Experts モデルで、コンテキストは 32,000 トークン。1 回の推論で 30 億パラメータだけを動かすから、速さと品質を両立してるんだって。
つぎに埋め込みの 2 つ。どちらも類似度は cosine を使うよ。
@cf/qwen/qwen3-embedding-0.6b:ベクトルは 1,024 次元、入力は最大 4,096 トークン。長めのチャンクを索引にするのに向いてるの。@cf/google/embeddinggemma-300m:Google の埋め込みモデルで、768 次元。入力は 512 トークンまでで、低レイテンシ重視の用途に最適化されてるよ。
対応モデルの全リストは Supported models を見てね。
まとめ
- AI Search にテキスト生成 2 つ・埋め込み 2 つ、計 4 つの Workers AI モデルが追加されたよ。
- テキスト生成は長文向けの GLM-4.7-Flash と、MoE で速い Qwen3-30B-A3B。
- 埋め込みは長いチャンク向けの Qwen3-Embedding-0.6B と、低レイテンシ重視の EmbeddingGemma-300M。
- 追加キー不要で、ダッシュボードや API から選ぶだけ。RAG や検索を Cloudflare で組んでるみんなに刺さる、小さめだけど嬉しいアップデートなの!