微软Azure适合多语言语音合成、识别与实时翻译,接入 SDK 即可在应用内嵌语音功能。 主要功能 1、合成 400+ 音色覆盖 140 语言; 2、实时语音识别返回带标点文本; 3、Speech Translation 即时双向翻译; 4、Custom Voice 训练专属音库; 5、语音关键词检测与说话人分离。
白描App白描,像猫一样灵动的扫描识别神器。简洁高效的ocr文字识别应用与文件扫描软件,拍照取字高效确度,高清晰的文件扫描,可生成PDF,包含iOS版,安卓版,小程序版,网页版(免费在线OCR文字识别),Windows版,Mac版,PC版。
GrokxAI 实时对话 AI,覆盖社交讨论、热点追踪并支持多轮深度交互,帮用户高效获取实时信息且互动有趣。 主要功能 1、支持接入 X 平台实时数据,实现热点信息秒级响应; 2、提供多轮对话深度交互,支持复杂问题逐步拆解解答; 3、支持幽默 / 犀利等个性化风格输出,适配社交互动场景; 4、允许自定义 Prompt 训练,优化专属对话逻辑。
DomoAIAI video editor that converts videos, text, and images into animation. Make your character move as you want.
识字体网识字体网是免费在线字体识别、品牌识别、字体下载、字体搜索和问答社区网站,免费下载Windows、macOS、Linux、Android、iOS/iPad/iPhone字体识别扫一扫软件。无人值守的自动识别和自动/手动拼字,结合人工智能、大数据和搜索技术,可快速识别中文、英文、日文、韩文等全球文字,帮您购买与使用合规字体避免字体侵权风险。
Deepseek适合开发者免费体验国产开源大模型,兼容 OpenAI 接口并提供联网搜索与思考链显示,便于原型与二次开发。 主要功能 1、开放 API 兼容 OpenAI,代码零改接入; 2、R1 模型 MIT 开源,附权重与技术报告; 3、联网搜索模式返回网页引用增强时效; 4、Reasoner 模型展示思考链,输出更透明; 5、提供多款蒸馏小模型,便于边缘部署。
LiblibAI适合在线调用多款开源模型免费生成 AI 图并在社区分享,快速获取灵感与素材。 主要功能 1、聚合百余 Stable Diffusion 模型风格多样; 2、文本到图像免显卡在线生成下载; 3、作品点赞收藏并克隆 Prompt 继续创作; 4、支持批量出图与高清放大;