tomai
登录
🧠

AI 模型

tomai.uk 的每一项 AI 功能都运行在具体、公开的模型之上——绝不含糊其辞。本页面列出每个模型、它驱动哪些功能、以及在哪里运行。模型变更时我们会同步更新本页。

最后更新: 2026-08-15

文本 AI:DeepSeek

所有基于文本的 AI 工具——命理解读(塔罗、星座运势、紫微斗数等)、AI 写作工具、AI 内容检测,以及守护 AI 图片生成的提示词安全过滤——均由 DeepSeek 的 deepseek-v4-flash 模型驱动(DeepSeek API,api.deepseek.com)。文本处理在 Cloudflare 边缘网络的服务端完成。

照片分析:Qwen3-VL-Plus

AI 手相分析与 AI 面相分析使用 Qwen3-VL-Plus(qwen3-vl-plus,阿里云百炼 DashScope)分析您上传的照片。照片分析通过安全隧道在我们的 VPS 上运行,报告正文随后由 DeepSeek 生成。

图像生成:豆包 Seedream 5.0 Pro

AI 图片生成器使用字节跳动火山方舟平台的豆包 Seedream 5.0 Pro(doubao-seedream-5-0-pro-260628)生成图片。

看图配文:LLaVA 1.5 7B

AI 图片描述工具使用 LLaVA 1.5 7B(@cf/llava-hf/llava-1.5-7b-hf,开源的 LLaVA 模型,运行在 Cloudflare Workers AI 上)理解您的图片,随后由 DeepSeek 撰写描述文案。

语音识别:Qwen3-ASR

AI 字幕使用开源的 Qwen3-ASR 模型在我们的 VPS 上转录音频。该功能当前在网站上暂停服务。

OCR:Tesseract

图片转文字与 OCR 工具使用开源 Tesseract OCR 从图片和 PDF 中读取文字。免费工具完全在您的浏览器中运行;云端 OCR 工具在我们的 VPS 上运行。

本页面的更新机制

模型会随供应商发布新版本而变化,我们也可能更换供应商。每当某功能的底层模型变更,我们都会更新本页面以及该工具页面上显示的模型。