Project Icon

budoux

独立小巧且多语言支持的机器学习换行工具

BudouX 是一款独立且小巧的机器学习换行整理工具,无需依赖第三方分词器,支持日语、简体中文、繁体中文和泰语。它占用空间小,约15KB,可用于客户端,并支持与HTML输入的集成。使用者可以通过提供数据集训练任何语言的模型,适用于Python、JavaScript和Java编程语言。该工具旨在解决CJK语言在网页排版中的分行问题,提高可读性。

FluentRead - 智能网页翻译工具 实现跨语言流畅阅读
AI翻译引擎Github多语言翻译开源项目流畅阅读浏览器翻译插件
FluentRead是一款功能丰富的浏览器翻译插件,支持多语言网页翻译。它提供仅译文和双语两种模式,整合了多种翻译引擎和AI模型。该插件具备快捷键、鼠标操作和滑动翻译等便捷功能,同时配备翻译缓存和回译功能,有效提升了跨语言阅读效率。FluentRead兼容主流浏览器,为用户提供智能、流畅的多语言网页阅读体验。
BMTools - 开源工具集成平台 赋能语言模型新能力
BMToolsGithub大语言模型工具学习开源项目插件开发
BMTools是一个开源项目,通过工具扩展语言模型能力,为社区提供工具构建和共享平台。该项目支持创建插件和使用ChatGPT插件,优化开源工具使用。BMTools提供单一和多工具接口,集成本地和在线工具,鼓励社区贡献。项目为研究人员提供工具学习和开发环境,推动语言模型与工具的融合研究。
dud - 高效数据版本管理与流程自动化工具
DudGithub命令行工具开源项目数据版本控制数据管道
Dud是一款轻量级数据版本管理工具,支持大文件处理和数据流程自动化。它采用YAML文件存储数据操作步骤,能够灵活构建数据处理流程。相比同类工具,Dud性能更优,操作更简单,专注于数据管理核心功能。它采用显式提交机制,默认使用符号链接,并通过Rclone实现高效的远程缓存管理。Dud不会隐式修改数据,为用户提供更可控的数据处理体验。
jtokkit - 专为OpenAI模型设计的Java分词库,提供便捷的API,支持多种编码和解码算法
GithubJTokkitJavaOpenAItokenizer开源项目自然语言处理
JTokkit是一个专为OpenAI模型设计的Java分词库,提供便捷的API,支持多种编码和解码算法如r50k_base和cl100k_base。该库无依赖,兼容Java 8及以上版本,并具备高效性能。用户可以通过Maven或Gradle轻松安装,并支持自定义编码算法。使用JTokkit,开发者能够轻松进行自然语言处理任务中的文本分词和令牌计算。
autocorrect - 跨平台中英文混排格式自动纠正工具
AutoCorrectGithub中英文混排代码检查开源项目文案纠正标点符号
AutoCorrect 是一个开源的文案纠正工具,使用 Rust 语言开发。它主要致力于改进中英文混排格式,包括自动添加空格、纠正标点符号和拼写检查等功能。该工具支持多种编程语言和文件格式,可以集成到持续集成环境、代码编辑器和其他应用中。AutoCorrect 旨在帮助开发者和内容创作者提升文案的规范性和专业性。
fugashi - 日语分词和形态分析的Cython高效解决方案
GithubMeCabUniDicfugashi开源项目日本分词自然语言处理
fugashi是一个基于MeCab的Cython包装器,为Python用户提供高效的日语分词和形态分析功能。它支持Linux、OSX和Windows平台,并推荐使用易于安装的UniDic词典。用户可以通过pip轻松安装fugashi及其词典,实现高效的日语文本处理。除了标准词典,fugashi还支持自定义词典,同时为研究人员提供引用支持,满足不同用户需求。
BambooAI - 利用大语言模型简化数据分析与交互
BambooAIGithubPython编程大语言模型开源项目数据分析自然语言处理
BambooAI是一款轻量级库,利用大型语言模型(LLMs)提供自然语言交互性能,支持数据集查询、互联网搜索和外部API集成。用户可通过简单的英语输入生成并执行数据分析和可视化的Python代码,无需广泛的编程知识。该工具旨在简化数据分析流程,提高数据分析师的工作效率。
data-juicer - 大语言模型数据处理系统,提供多模态数据支持
Data-JuicerGithub多模态数据处理大规模语言模型开源项目数据处理数据模型协同开发
Data-Juicer 是一款强大的一站式数据处理系统,专为大语言模型设计。它支持多模态数据处理,具有80多种操作符和20多个配置方案,提供高效且并行的数据处理能力。其友好的用户体验和全面的文档,使其成为生产环境中的优选方案。
sd-webui-bilingual-localization - Stable Diffusion双语UI扩展,提升用户操作体验
GithubStable Diffusionbilingual localizationweb UI安装开源项目翻译
这个项目为Stable Diffusion web UI提供双语本地化扩展,支持动态标题翻译和灵活的正则表达式模式。用户可以通过两种安装方法来使用该扩展,且兼容现有语言包插件,无需重新导入。该扩展有效防止全局污染,确保界面元素的精确翻译。
mokuro - 日本漫画OCR工具,为学习者提供可选文本阅读体验
GithubOCR技术mokuro开源项目文本检测日语漫画阅读器
mokuro是一个开源项目,为日语学习者提供了便捷的漫画阅读工具。该工具通过文本检测和OCR技术,将日本漫画中的文字转换为可选文本。mokuro离线处理漫画页面,生成包含OCR结果的.mokuro文件,用户可通过网页阅读器浏览处理后的漫画。支持弹出字典功能,方便学习者查询生词。此外,mokuro具备多卷处理能力,并兼容旧版HTML格式,适合各类漫画爱好者和日语学习者使用。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

白日梦AI

白日梦AI提供专注于AI视频生成的多样化功能,包括文生视频、动态画面和形象生成等,帮助用户快速上手,创造专业级内容。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

讯飞绘镜

讯飞绘镜是一个支持从创意到完整视频创作的智能平台,用户可以快速生成视频素材并创作独特的音乐视频和故事。平台提供多样化的主题和精选作品,帮助用户探索创意灵感。

Project Cover

讯飞文书

讯飞文书依托讯飞星火大模型,为文书写作者提供从素材筹备到稿件撰写及审稿的全程支持。通过录音智记和以稿写稿等功能,满足事务性工作的高频需求,帮助撰稿人节省精力,提高效率,优化工作与生活。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号