Long-Novel-GPT: 基于人工智能的长篇小说生成器

RayRay
Long-Novel-GPT长篇小说生成器结构化写作反思循环API调用成本Github开源项目

Long-Novel-GPT:开启AI辅助长篇小说创作的新纪元

在人工智能快速发展的今天,AI技术正在各个领域展现出惊人的潜力。文学创作,这个曾被认为是人类独有领域的最后堡垒,如今也迎来了AI的挑战。Long-Novel-GPT项目应运而生,它是一个基于GPT等大语言模型的长篇小说生成器,旨在为作家和创作者提供强大的AI辅助工具,帮助他们创作出高质量的长篇小说。

项目简介:AI驱动的文学创作新范式

Long-Novel-GPT采用了层次化的大纲/章节/正文结构,这种结构设计使得AI能够更好地把握长篇小说的连贯剧情。通过精心设计的上下文管理,项目还实现了API调用成本的优化。更重要的是,Long-Novel-GPT具备自我反思和优化的能力,它能根据自身或用户的反馈不断进行调整,直至达到预定的创作目标。

项目的核心目标是根据用户提供的初步创意(例如:"我想写一部科幻冒险小说"),通过AI不断完善和构建小说内容,最终生成达到人类作家水平的长篇小说。这一雄心勃勃的目标,体现了AI在文学创作领域的巨大潜力。

关键特性:AI创作的三大支柱

Long-Novel-GPT的成功,源于其三大核心特性:

  1. 结构化写作:项目采用层次化的大纲/章节/正文来进行结构化写作。这种方法不仅能有效把握长篇小说的发展脉络,还能确保故事情节的连贯性和逻辑性。通过这种结构,AI可以像经验丰富的作家一样,从宏观到微观逐步构建小说世界。

  2. 反思循环:Long-Novel-GPT在创作过程中不断进行自我反思和优化。它会对生成的大纲、章节和正文内容进行评估,并根据评估结果进行调整。这种反复的反思和修改过程,模拟了人类作家精雕细琢的创作过程,有助于提高小说的整体质量。

  3. 成本优化:通过巧妙的上下文管理,项目实现了API调用成本的优化。每次API调用的费用被固定,不会因反思次数的增加而上升。这一特性使得Long-Novel-GPT在保持高质量输出的同时,也能控制成本,为长期使用和大规模应用奠定了基础。

Long-Novel-GPT工作流程

使用指南:开启你的AI辅助创作之旅

要开始使用Long-Novel-GPT,用户需要遵循以下步骤:

  1. 环境配置: 首先,创建一个名为lngpt的conda环境:

    conda create -n lngpt python
    conda activate lngpt
    pip install -r requirements.txt
    
  2. 启动界面: Long-Novel-GPT提供了一个直观的Gradio Demo界面。通过以下命令启动:

    cd Long-Novel-GPT
    python demo/app.py
    
  3. 界面操作: Gradio Demo包含5个主要页面:

    • 生成小说名:这是初始页面,用于新建或加载小说项目。
    • 生成大纲:在这里生成小说的整体框架。
    • 生成章节:细化小说的各个章节。
    • 生成正文:编写小说的具体内容。
    • 设置:配置OpenAI API和其他生成参数。

Gradio Demo界面预览

使用ChatGPT作为API:降低使用门槛

为了让更多用户能够无障碍地使用Long-Novel-GPT,项目还支持直接使用ChatGPT网页版作为API。这一功能大大降低了使用成本,使得即使没有OpenAI API密钥的用户也能体验AI辅助创作的乐趣。

要使用ChatGPT作为API,用户需要遵循以下步骤:

  1. 安装AutoChatScript:访问AutoChatScript GitHub仓库并按照说明进行安装。

  2. 启动服务:

    cd AutoChatScript
    python openai_api.py --server-port 8000
    
  3. 配置Demo:在设置页面中,将ChatGPT的base_url设置为http://localhost:8000/v1/

通过这种方式,用户可以充分利用ChatGPT的强大功能,同时避免了API调用费用。

项目发展:持续优化,不断创新

Long-Novel-GPT项目一直在快速迭代和发展。最新的1.5版本带来了多项重要更新:

  1. 所有prompt更新采用三段式逻辑,先生成上下文,再生成修改意见,最后进行修改。
  2. 通过RAG(检索增强生成)技术抽取上下文,提高生成质量。
  3. 支持重来/取消/回退当前操作,给用户更多控制权。

未来,项目团队计划继续优化prompt的运行速度,并探索由AI给出创作建议的功能,进一步提升用户体验和创作效率。

使用建议:发挥AI的最大潜力

为了充分利用Long-Novel-GPT的功能,用户应注意以下几点:

  1. 优先选择GPT-4或文心4 API,以获得更高质量的生成结果。
  2. 在设置页面中正确配置API,这是使用的前提。
  3. 用户可以灵活选择生成大纲、章节或正文,根据自己的创作需求定制流程。
  4. 如遇问题,可尝试刷新页面或重启程序。

开源贡献:共同推动AI创作的未来

Long-Novel-GPT是一个开源项目,欢迎所有形式的贡献。无论是新功能建议、代码改进,还是bug报告,项目团队都热烈欢迎。有兴趣的开发者和创作者可以通过GitHub issues或pull requests参与到项目中来,共同推动AI辅助创作技术的发展。

结语:AI与人类创意的完美结合

Long-Novel-GPT项目展示了AI在文学创作领域的巨大潜力。它不仅是一个强大的创作工具,更是人工智能与人类创意结合的典范。通过结构化写作、反思循环和成本优化等创新特性,Long-Novel-GPT为作家和创作者提供了一个全新的创作平台。

随着项目的不断发展和完善,我们可以期待看到更多由AI辅助创作的高质量长篇小说问世。Long-Novel-GPT不仅仅是一个工具,它代表了文学创作的新范式,正在逐步改变我们对创作过程的认知。

在这个AI快速发展的时代,Long-Novel-GPT为我们展示了技术如何能够增强而非取代人类的创造力。它不是要替代作家,而是要成为作家的得力助手,帮助他们突破创作瓶颈,探索新的创作可能性。

对于有志于尝试AI辅助创作的作家和爱好者来说,Long-Novel-GPT无疑是一个值得关注和尝试的项目。通过与AI的协作,也许你将发现创作的新乐趣,创造出超乎想象的文学作品。让我们一起期待AI辅助创作带来的无限可能,共同书写文学创作的新篇章.

编辑推荐精选

AEE

AEE

AI Excel全自动制表工具

AEE 在线 AI 全自动 Excel 编辑器,提供智能录入、自动公式、数据整理、图表生成等功能,高效处理 Excel 任务,提升办公效率。支持自动高亮数据、批量计算、不规则数据录入,适用于企业、教育、金融等多场景。

UI-TARS-desktop

UI-TARS-desktop

基于 UI-TARS 视觉语言模型的桌面应用,可通过自然语言控制计算机进行多模态操作。

UI-TARS-desktop 是一款功能强大的桌面应用,基于 UI-TARS(视觉语言模型)构建。它具备自然语言控制、截图与视觉识别、精确的鼠标键盘控制等功能,支持跨平台使用(Windows/MacOS),能提供实时反馈和状态显示,且数据完全本地处理,保障隐私安全。该应用集成了多种大语言模型和搜索方式,还可进行文件系统操作。适用于需要智能交互和自动化任务的场景,如信息检索、文件管理等。其提供了详细的文档,包括快速启动、部署、贡献指南和 SDK 使用说明等,方便开发者使用和扩展。

Wan2.1

Wan2.1

开源且先进的大规模视频生成模型项目

Wan2.1 是一个开源且先进的大规模视频生成模型项目,支持文本到图像、文本到视频、图像到视频等多种生成任务。它具备丰富的配置选项,可调整分辨率、扩散步数等参数,还能对提示词进行增强。使用了多种先进技术和工具,在视频和图像生成领域具有广泛应用前景,适合研究人员和开发者使用。

爱图表

爱图表

全流程 AI 驱动的数据可视化工具,助力用户轻松创作高颜值图表

爱图表(aitubiao.com)就是AI图表,是由镝数科技推出的一款创新型智能数据可视化平台,专注于为用户提供便捷的图表生成、数据分析和报告撰写服务。爱图表是中国首个在图表场景接入DeepSeek的产品。通过接入前沿的DeepSeek系列AI模型,爱图表结合强大的数据处理能力与智能化功能,致力于帮助职场人士高效处理和表达数据,提升工作效率和报告质量。

Qwen2.5-VL

Qwen2.5-VL

一款强大的视觉语言模型,支持图像和视频输入

Qwen2.5-VL 是一款强大的视觉语言模型,支持图像和视频输入,可用于多种场景,如商品特点总结、图像文字识别等。项目提供了 OpenAI API 服务、Web UI 示例等部署方式,还包含了视觉处理工具,有助于开发者快速集成和使用,提升工作效率。

HunyuanVideo

HunyuanVideo

HunyuanVideo 是一个可基于文本生成高质量图像和视频的项目。

HunyuanVideo 是一个专注于文本到图像及视频生成的项目。它具备强大的视频生成能力,支持多种分辨率和视频长度选择,能根据用户输入的文本生成逼真的图像和视频。使用先进的技术架构和算法,可灵活调整生成参数,满足不同场景的需求,是文本生成图像视频领域的优质工具。

WebUI for Browser Use

WebUI for Browser Use

一个基于 Gradio 构建的 WebUI,支持与浏览器智能体进行便捷交互。

WebUI for Browser Use 是一个强大的项目,它集成了多种大型语言模型,支持自定义浏览器使用,具备持久化浏览器会话等功能。用户可以通过简洁友好的界面轻松控制浏览器智能体完成各类任务,无论是数据提取、网页导航还是表单填写等操作都能高效实现,有利于提高工作效率和获取信息的便捷性。该项目适合开发者、研究人员以及需要自动化浏览器操作的人群使用,在 SEO 优化方面,其关键词涵盖浏览器使用、WebUI、大型语言模型集成等,有助于提高网页在搜索引擎中的曝光度。

xiaozhi-esp32

xiaozhi-esp32

基于 ESP32 的小智 AI 开发项目,支持多种网络连接与协议,实现语音交互等功能。

xiaozhi-esp32 是一个极具创新性的基于 ESP32 的开发项目,专注于人工智能语音交互领域。项目涵盖了丰富的功能,如网络连接、OTA 升级、设备激活等,同时支持多种语言。无论是开发爱好者还是专业开发者,都能借助该项目快速搭建起高效的 AI 语音交互系统,为智能设备开发提供强大助力。

olmocr

olmocr

一个用于 OCR 的项目,支持多种模型和服务器进行 PDF 到 Markdown 的转换,并提供测试和报告功能。

olmocr 是一个专注于光学字符识别(OCR)的 Python 项目,由 Allen Institute for Artificial Intelligence 开发。它支持多种模型和服务器,如 vllm、sglang、OpenAI 等,可将 PDF 文件的页面转换为 Markdown 格式。项目还提供了测试框架和 HTML 报告生成功能,方便用户对 OCR 结果进行评估和分析。适用于科研、文档处理等领域,有助于提高工作效率和准确性。

飞书多维表格

飞书多维表格

飞书多维表格 ×DeepSeek R1 满血版

飞书多维表格联合 DeepSeek R1 模型,提供 AI 自动化解决方案,支持批量写作、数据分析、跨模态处理等功能,适用于电商、短视频、影视创作等场景,提升企业生产力与创作效率。关键词:飞书多维表格、DeepSeek R1、AI 自动化、批量处理、企业协同工具。

下拉加载更多