好友
阅读权限10
听众
最后登录1970-1-1
|
上个星期逛论坛发现了这个帖子(见下文),功能实用,适合小朋友,但发现跟我的需求有所欠缺,变自己动手改了改,做了些优化。
原帖:语音朗读(给孩子报听写用)https://www.52pojie.cn/thread-2116081-1-1.html
本修改版主要增加了图片、PDF、Wrod 的原文阅读的能力。
因为我的使用场景是拍小朋友的课文或上传PDF版教材朗读,能看到原文更方便小朋友跟读。
其他的修改就不值一提了,感兴趣的自己去发现哈。
关于本地模型
最初曾计划在 App 内集成离线模型引擎,但受限于原有技术栈版本较低,所支持的模型引擎只能处理纯文本、不支持多模态(看图/图片识别),无法承担拍照与文档 OCR 类任务。
随后尝试把整体技术栈升级到当前最新稳定版本再接入引擎,支持的模型依旧有限且效果不理想;
故再次尝试升级到开发版,但因问题太多,无法成功编译,无奈放弃,以后有空再换架构重写吧。
如有大佬感兴趣,欢迎继续完善,搞定模型引擎。
仓库地址 https://github.com/EasongChung/speak_reader
Speak Reader Android APK
版本: v2.5.7-20260803-075228
架构: arm64-v8a
大小:23MB 下载地址:https://wwbki.lanzouv.com/iH3AW40c6eob 密码:d2iq
测试截图: ( 注 图1显示的本地模型为测试版,已放弃,仅用于图片识别测试 )
|
免费评分
-
查看全部评分
|
发帖前要善用【论坛搜索】功能,那里可能会有你要找的答案或者已经有人发布过相同内容了,请勿重复发帖。 |
|
|
|
|
|