# AI Search に Workers AI の新モデルが 4 つ仲間入り！

やっほー、しぃちゃんだよ！今日は AI 検索まわりで、選べるモデルが増えたっていうニュースを見つけたから紹介しちゃうね。

## なにが発表されたの？

Cloudflare の Changelog によると、[AI Search](https://developers.cloudflare.com/ai-search/) がテキスト生成と埋め込み(embedding)で使える [Workers AI](https://developers.cloudflare.com/workers-ai/) のモデルを 4 つ追加したんだって。テキスト生成用に 2 つ、埋め込み用に 2 つの構成なの。

## 今までどうだったの？

AI Search は、みんなのデータを取り込んで検索や RAG に使える仕組み。その中で「文章を作るモデル」と「ベクトルに変換する埋め込みモデル」を選ぶんだけど、選択肢が増えると、扱う文書の長さや速度の好みに合わせやすくなるよね。

## これで何が変わるの？

追加された 4 モデルは全部 Workers AI の上で動くから、別のプロバイダのキーを用意しなくてもそのまま使えるの。ダッシュボードや API で AI Search インスタンスを作る・更新するときに選べるよ。

## 深く潜ってみよう

まずテキスト生成の 2 つ。

- `@cf/zai-org/glm-4.7-flash`:Zhipu AI の軽量モデルで、コンテキストウィンドウは 131,072 トークン。長い文書の要約や検索タスクに向いてるって。
- `@cf/qwen/qwen3-30b-a3b-fp8`:Alibaba の Mixture-of-Experts モデルで、コンテキストは 32,000 トークン。1 回の推論で 30 億パラメータだけを動かすから、速さと品質を両立してるんだって。

つぎに埋め込みの 2 つ。どちらも類似度は cosine を使うよ。

- `@cf/qwen/qwen3-embedding-0.6b`:ベクトルは 1,024 次元、入力は最大 4,096 トークン。長めのチャンクを索引にするのに向いてるの。
- `@cf/google/embeddinggemma-300m`:Google の埋め込みモデルで、768 次元。入力は 512 トークンまでで、低レイテンシ重視の用途に最適化されてるよ。

対応モデルの全リストは [Supported models](https://developers.cloudflare.com/ai-search/configuration/models/supported-models/) を見てね。

## まとめ

- AI Search にテキスト生成 2 つ・埋め込み 2 つ、計 4 つの Workers AI モデルが追加されたよ。
- テキスト生成は長文向けの GLM-4.7-Flash と、MoE で速い Qwen3-30B-A3B。
- 埋め込みは長いチャンク向けの Qwen3-Embedding-0.6B と、低レイテンシ重視の EmbeddingGemma-300M。
- 追加キー不要で、ダッシュボードや API から選ぶだけ。RAG や検索を Cloudflare で組んでるみんなに刺さる、小さめだけど嬉しいアップデートなの！
