ocr-recognize-text API | MuAPI: alat AI

Jelajahi dan integrasikan model AI ocr-recognize-text melalui MuAPI. Dapatkan inferensi berkecepatan tinggi dan harga kompetitif.

📝

Overview

About this model

Model ocr-recognize-text menyediakan kemampuan generasi AI mutakhir di platform MuAPI.

1Aplikasi produksi dengan ocr-recognize-text
2Aplikasi produksi dengan ocr-recognize-text
3Aplikasi produksi dengan ocr-recognize-text
4Aplikasi produksi dengan ocr-recognize-text
5Aplikasi produksi dengan ocr-recognize-text
💰

Pricing & Value

Cost analysis

muapiapp$0.02 per generation

按图像固定费率计费,与检测到的文本片段数量无关。

Fal.aiTidak tersedia

目前没有列出专用的本地 OCR 文本检测端点。

ReplicateBervariasi tergantung model

虽然存在独立的 OCR 模型,但没有像此服务一样将其整合为带边界框和置信度的文本检测 API。

** Competitor pricing is estimated based on similar model architectures and usage tiers.

⚙️

Technical Details

Configuration schema

Gambar URLstring

用于识别文本的Gambar URL。

Default Valuehttps://d3adwkbyhxyrtq.cloudfront.net/ai-images/example-poster.jpg
📖

Implementation Guide

Developer documentation

Panduan integrasi cepat untuk ocr-recognize-text. Hubungkan dengan kunci API MuAPI Anda dan mulai lakukan panggilan inferensi.

Common Questions

Frequently asked

OCR Recognize Text 可以做什么?

它会扫描输入图像,返回检测到的每个文本片段及其边界框(以图像尺寸比例表示)和置信度分数,不会重新生成或修改图像。

可以配置哪些参数?

唯一必需的输入是 `image_url`,即要扫描图像的公开 URL。还可以提供可选的 `webhook_url`,以异步接收结果。

为什么 `bbox` 返回的是比例而不是像素?

比例坐标(0–1 范围)可以让同一个边界框无论检测和后续编辑之间发生何种缩放,都能正确应用,无需额外的单位换算。

`confidence` 字段是什么意思?

每个片段都会根据 OCR 引擎的内部识别分数标记为 `high`、`medium` 或 `low`,因此下游逻辑可以选择忽略低置信度噪声。

它能否用于编辑图像中的文本,而不只是检测文本?

OCR Recognize Text 只能检测并返回文本片段。若要修改文本,请将检测到的片段和期望的替换内容作为后续请求传给图像编辑模型。

支持哪些图像格式?

支持从公开可访问 URL 提供的标准 Web 图像格式(JPG、PNG、WebP)。