这里是我们探索人工智能核心技术的前沿阵地,聚焦 OCR、ASR、TTS 与大语言模型 四大方向,打造实用、高效的智能工具与服务。
⚠️ 说明:AI 应用(大模型、OCR、ASR、TTS)普遍比较消耗算力,而本站服务器资源有限,连跑个 0.5B 的小模型都又慢又卡。因此下方所有示例均不支持在线演示。想先看效果的,点击对应卡片即可观看演示视频;需要在自己环境里跑起来的,可联系博主进行离线部署。
轻量级大语言模型,可在低性能设备上运行(效果有限,仅供参考)。不支持在线演示,点击观看演示视频,或联系博主离线部署。
高精度文字检测与识别,支持多场景、多角度图像。不支持在线演示,点击观看演示视频,或联系博主离线部署。
支持中文普通话语音文件转录,准确率高达 95%+。不支持在线演示,点击观看演示视频,或联系博主离线部署。
一键将小说、文章转为有声内容,支持章节分割。不支持在线演示,点击观看演示视频,或联系博主离线部署。