Mistral OCR 4 – Mistral AI 推出的最新一代文档理解模型
Mistral OCR 4 是 Mistral AI 推出的最新一代文档理解模型。模型支持从 PDF、图片、演示文稿等复杂文档中提取文本,能返回带边框定位、区域类型分类和置信度...
0 条评论
文章详情
暂未添加详细介绍。
为你推荐
豆包音频生成模型1.0 – 火山引擎推出的端到端音频创作模型
豆包音频生成模型1.0(Seed-Audio 1.0)是火山引擎推出的端到端音频创作模型,支持文本或音频作为参考输入生成目标音频。
袋马 – 高德推出的 AI 应用生成平台
袋马(daimax)是高德推出的 AI 应用生成平台,主打 Vibe Coding 零代码开发。用户用自然语言描述需求,可在分钟级生成可上线的小程序或 iOS 原生应用。
用箭头标注精准修改 AI 图片,Cowart 项目已获 2k+ Stars
今天发点适合做图片的东西。 平时用 AI 生图,喜欢的风格可以搜,提示词也有现成参考,效果不满意就多生成几次。真正麻烦的是,成图已经有八九分满意,偏偏还...
豆包音频生成模型1.0实测 – 多角色配音、有声书一键生成
你可能也在烦恼:用 AI 生成大片,画面质感已经很到位了,可角色一开口,瞬间让人出戏。 画面里明明在经历生死关头,配音听起来却像在四平八稳地念产品说明...
支付宝AI开放平台 – 蚂蚁集团推出的企业级AI服务生态平台
支付宝AI开放平台是蚂蚁集团推出的企业级AI服务生态平台,面向商家与开发者提供一次接入、多端分发的AI化升级方案。商家可将存量小程序、API接口封装为MCP、S...
虎牙VAM 1.0 – 虎牙推出的实时多模态数字人基础模型
虎牙VAM 1.0(Vivid Avatar Model)是虎牙推出的基于DiT架构的实时多模态数字人基础模型,一张照片可生成能说话、能唱歌跳舞的AI数字人。
评论
0 条已审核评论登录 后可以发表评论。
还没有审核通过的评论。