AI资讯

首款藏语AI输入法发布:支持汉英混输,手机电脑全终端可用

智能摘要

输入法及配套藏文字体集正式发布。输入法以智达大模型作为核心技术底座开发而成。识别输入可拍照或截图识别汉、藏、英混合文字,适用于文献数字化、教学材料整理与办公场景。个学科的术语,并能自动记忆用户的输入习惯、常用词与表达方式。

我国的第一款藏语多模态人工智能输入法在九月二十日这个日子在青海这个地方亮相, 它具备了打字, 以及语音, 还有拍照识别的三大功能合为一体, 并且实现了对三种方言的全面覆盖这种情况对于那些身处藏区的师生群体, 还有那些办公人员而言, 意味着这是一次确实能够带来的工具方面的实质性升级表现。

青海师大建校70周年推出重磅成果

在九月二十号这天, 青海师范大学办了个大会。这个会的名头叫教师教育高质量发展暨建校七十周年大会。到了科研的那个成果展示的部分, 有个东西被正式发布了。这个东西就是智达AI输入法。

同时发布的还有配套的藏文字体集。它们是属于藏语智能全国重点实验室的。这一发布的情况, 直接就把现场的人的关注点给吸引住了。整个场面因此就变得受到关注了。

该输入法是依托于实验室的自主知识产权大模型来开发的, 它覆盖了手机和电脑这些全终端。用户只需要注册一个账号, 那么词库和输入的习惯就能在这多个设备之间进行同步了, 所以即便在出差、在家、在学校这些场景下进行切换时候, 也不用再次去适应新的输入方式。

三种输入方式覆盖日常需求

这文本的输入是严格遵循了国家标准对于藏语键盘布局的要求的,它是同时支持那种藏文和拉丁转写的方式的, 对于初学者来说, 如果他们是用拼音式的去打字的方法的话, 那也是能够打出那个藏文来的, 这样的话, 他们上手的门槛也就比较低了一些, 或者说它让上手变得不困难了。

语音输入这个功能是可以识别出包括汉字、藏语以及英语在内的混合语音内容的。OCR文字识别这块儿是支持通过拍照或者是截图的方式, 去读取里面混杂在一起的多种文字的。

无论是在进行文献的数字化处理工作, 还是在整理教学所使用的材料阶段, 又或者是在填写办公室的各种表格场景之中, 都是可以使用的。这样子做的话, 就能够省去掉那些需要逐字来进行手动输入的时间消耗了。

三大方言语音输入全面打通

这个语音模块涵盖了卫藏、安多, 以及康巴这三大方言区的书面语内容, 与此同时它也覆盖了对应的口语表达情况。青海师范大学的教授也是该实验室常务副主任的多拉对此进行了说明。

他指出这是一件具有开创性的事情, 因为在过去的很长时间里并没有相关技术, 而现在是国内首次做到的事情, 那就是把这三种不同方言中的语音功能全部都整合到了一个输入法系统当中去实现共享。

不同方言区的使用者, 是不用再切换工具的, 日常口语可以直接语音转文字。这对藏语母语者来说很实用, 对跨方言区交流的人也很实用, 沟通效率是明显提升的。

词库和字体集同步公开

这个输入法的词库覆盖了包括教育、法律、文学在内的, 总计23个学科的术语, 同时它还能自动记忆用户日常常用的词汇, 并且记录用户的表达习惯, 因此使用时间越长, 操作起来就越加顺手。

在同日进行的这项举措当中, 发布了包含藏文字体的集合, 该集合里面涵盖了四种不一样的风格, 这四种风格分别是黑体、白体、艺术体以及毛笔体, 这些字体都是专门适配当前的该输入法在显示上面的具体需求。

无论是进行页面的排版操作、纸质的印刷流程, 还是涉及到电子相关文档的处理环节, 大家都可以直接地使用。这一状况的出现, 有效地解决了过去由于显示不统一而留下的老问题。

智达大模型撑起技术底座

发布会上, 智达大模型也同时进行了展示。这个模型一共包含9个版本。它的参数规模是从8亿到1000亿。线上部署了三大主力模型。它支持56种语言的互译以及图像和视频的理解。

这些模型可服务于教育领域, 以及科研领域, 还有政务领域等等方面, 为藏语的信息化工作提供底层的算力支撑, 同时, 也给后续的功能扩展留足了升级空间。

藏语数字化进程再进一步

对于青海、西藏、四川、甘肃, 像这些地方属于藏区来说, 这款输入法, 它直接就把藏语数字内容在生产和使用方面的门槛给降低掉了。像是教师在进行备课工作的时候, 学生去查找资料的时候, 以及政府部门在处理公文的时候, 这款软件都能够派上用场。

你认为藏语AI输入法究竟会在哪一种实际场景里面率先实现大规模的普及运用? 这究竟是发生在课堂教学的场合里面, 还是出现在日常办公的工作环节里面? 欢迎你在评论区域里面分享你的个人看法和交流讨论。如果你认为这个提问内容确实具有实用价值的话, 请点击点赞图标, 并且将其转发给你的朋友去阅读和知晓一下。

相关文章