从零到 TextIn:深入探讨 API 集成,释放文字识别的威力

前言
当我们踏入数字化时代,文字不再只是静态的字符,而是成为了信息传递和智能决策的核心。在这个时代,我们急需先进的智能文字识别技术,以便让机器更深刻地理解和处理文本信息。而合合信息公司作为一家引领行业的先锋,不仅仅提供了文字处理的解决方案,更带来了智能文字识别的革命。
无论您是技术爱好者、开发者,还是对智能技术充满好奇心的读者,都将在本文中找到关于 TextIn 文字识别的全面解读。让我们一同走进文字的智能化时代,探索如何快速集成 TextIn 让机器真正理解和处理文字信息的奥秘。
TextIn 的 API 申请
首先,您需要在 TextIn 官网注册一个账号,并在个人账户的工作台界面获取相应的机器人产品。值得一提的是,新用户可获得 1000 次的免费额度,足够您体验和集成开发相当一段时间。

现在,您已经可以使用 API 了,接下来我们将解决以下两个问题: 1.我们该如何快速调用它的 API 进行使用 2.如何在调用的时候证明我们的身份
我们接下来一个个去解决
我提供了两种集成 TextIn 的方法,如果想要快速使用可以直接跳到第二部分查看 TextIn SDK 集成
一、TextIn 的 API 调用实战
首先,我们需要在工作台的总览页面右下角找到身份验证所需的 x-ti-app-id 和 x-ti-secret-code,保存这两个数据。

紧接着,访问您想要调用的机器人模型的官方文档,找到该机器人对应的请求 URL 和示例代码。将示例代码复制到您的电脑并运行即可。

封装发送请求工具类
以图片识别机器人为例,我们创建了一个 TextIn 发送请求的工具类。该工具类中包含了对不同机器人的请求方法,以便于代码复用。
将请求的机器人模型的 url 和图片文件作为方法参数传入,加强代码的复用性,并提取相关的 appId 和 secretCode 参数存放在常量类中,避免魔法数字和提高代码可读性
封装模型调用工具类
由于对于不同机器人的调用有着不同的请求 url 和不同的返回值处理方法,我们再定义一个工具类便于按需调用不同的模型,同样我们以图片识别为例,首先将图片识别机器人请求 url 存放在我们对应的常量类中,按照官方文档给出的返回值结果获取或者我们可以自己根据返回值结果来个性化提取,由于返回值是 JSON 格式,我采用了谷歌的 Gson 工具来解析提取文本,当然还有 Hutool 的 JSONUtil 工具库也非常值得使用

我们在官方的 maven 仓库找一个使用量最多的 Gson 依赖引入我们的 pom.xml 文件
当我们准备开始调用 TextIn 的 API 进行我们的操作时,我们还需要考虑一个问题,当我们调用 API 失败时,我们该如何知道出现了什么问题呢?在官方文档的最下方,给出了所有可能的错误码和对应的信息,我们可以根据调用 API 返回的错误码来获取错误信息

对于这个问题我们可以根据官方提供的所有的错误码和信息设计一个简单的枚举类,并在枚举类中提供一个可以根据错误码获取对应的错误信息的方法
然后我们就可以定义我们的工具类来使用图片识别机器人的功能
这样我们就可以在需要的时候传入图片文件数据,调用 TextIn 发送请求工具类,并传入图片数据和对应的机器人请求 url。最后,提取图片中识别出来的每一行数据,封装为一个集合返回,完成对图片识别 API 的集成
以下是 API 调用的关系结构
- controller -> JudgeImageUtils (controller 层使用工具类的不同方法指定需要调用的模型)
- JudgeImageUtils -> TextInSendUtils (模型调用工具类使用 TextIn 产品请求发送工具类)
实现多层解耦,提高代码的灵活性、可维护性和可扩展性
调用示例
最后在 swagger 文档中测试图片的识别结果

二、集成 TextIn SDK
根据以上的步骤我们可能会觉得,仍然有些繁琐,那可以怎么样再次简化我们的集成流程呢?我针对 TextIn 产品的一些功能方法做了对应的 SDK,如果需要使用可以直接去 maven 官方仓库下载依赖或者在我的 github 仓库中下载我的依赖包导入本地。
由于 sonatype 2024 年暂时关闭了创建问题的功能,maven 仓库暂时无法使用我的 SDK
github 仓库地址:https://github.com/my5411/textIn-client-sdk
导入依赖
首先将对应的依赖导入我们项目的 pom.xml 文件
开始使用
github 仓库中的 README.md 文件仅供参考
身份鉴权
在我们项目的 application.yml 文件中加入我们账户对应的鉴权信息
创建客户端
直接在项目需要使用的位置注入相关的 bean 即可快速创建 TextIn 使用的客户端
客户端测试
使用客户端的 testConnect 方法测试客户端的连通性,然后就可以使用提供的图像识别方法进行简单的测试,以下是图片识别简单的代码实例
同样,我们还提供了相应的表格图片识别和图片剪切增强功能,更多功能期待您的发现和补充。
结语
通过本文,我们深入了解了如何申请 TextIn 的 API,快速调用并集成。作为技术爱好者和开发者,我们不仅仅是观望者,更是创造者,通过 TextIn 的强大功能,我们能够将智能文字识别融入到自己的项目中,赋予应用更多可能性。
这个旅程中,我们不仅仅是解锁了 TextIn API 的潜力,更是在技术的海洋中航行,不断探索前行。文字识别只是冰山一角,未来的可能性无限,让我们一起勇敢地面对挑战,将智能技术融入更多的场景,创造出更加美好和智能的世界。
感谢您的阅读,希望您在 TextIn 的文字智能化时代中,探索出更多的精彩故事。让我们携手共建智能未来!
这篇文章我同样发布在了稀土掘金平台,地址为:https://juejin.cn/post/7341340317658890249
