每日精粹

  1. chatnio: 开源的一站式AI前端解决方案这是一个开源的前端项目

    chatnio: 开源的一站式AI前端解决方案

    这是一个开源的前端项目。AI 一站式解决方案,一站式 Chat + 中转 API 站点,支持 OpenAI,Midjourney,Claude,讯飞星火,Stable Diffusion,DALL·E,ChatGLM,通义千问,腾讯混元,360 智脑,百川 AI,火山方舟,新必应,Gemini,Moonshot 等模型,支持对话分享,自定义预设,云端同步,模型市场,支持弹性计费和订阅计划模式,支持图片解析,支持联网搜索,支持模型缓存,丰富美观的后台管理与仪表盘数据统计。

    https://github.com/Deeptrain-Community/chatnio/blob/main/README_zh-CN.md chatnio/README_zh-CN.md at main · Deeptrain-Community/chatnio

  2. VideoTrans视频翻译和配音一键字幕识别+翻译+配音=带新语言字幕和配音的视频【翻译视频并配音】根据需要设置各个选项,自由配置组合,实现翻译和配音、自动加减速、合并等【识别字幕不翻译】选择视频文件,选择视频源语言,则从视频【语音中识别出文字】并自动导出字幕文件到目标文件夹【提取字幕并翻译】选择视频文件,选择视频源语言,设置想翻译到的目标语言,则从【视频语音中识别出文字】并翻译为目标语言,然后导出双语字幕文件到目标文件夹【字幕和视频合并】选择视频,然后将已有的字幕文件拖拽到右侧字幕区,将源语言和目标语言都设为字幕所用语言、然后选择配音类型和角色,开始执行【为字幕创建配音】将本地的字幕文件拖拽到右侧字幕编辑器,然后选择目标语言、配音类型和角色,将生成配音后的音频文件到目标文件夹【音视频识别文字】将视频或音频拖拽到识别窗口,将识别出文字并导出为srt字幕格式【将文字合成语音】将一段文字或者字幕,使用指定的配音角色生成配音【从视频分离音频】将视频文件分离为音频文件和无声视频【音视频字幕合并】音频文件、视频文件、字幕文件合并为一个视频文件【音视频格式转换】各种格式之间的相互转换【文字字幕翻译】将文字或srt字幕文件翻译为其他语言【人声背景乐分离】将视频中的人声和背景音乐分别分离出来,生成2个音频文件【下载油管视频】可从youtube上下载视频

    VideoTrans视频翻译和配音
    一键字幕识别+翻译+配音=带新语言字幕和配音的视频

    【翻译视频并配音】根据需要设置各个选项,自由配置组合,实现翻译和配音、自动加减速、合并等
    【识别字幕不翻译】选择视频文件,选择视频源语言,则从视频【语音中识别出文字】并自动导出字幕文件到目标文件夹
    【提取字幕并翻译】选择视频文件,选择视频源语言,设置想翻译到的目标语言,则从【视频语音中识别出文字】并翻译为目标语言,然后导出双语字幕文件到目标文件夹
    【字幕和视频合并】选择视频,然后将已有的字幕文件拖拽到右侧字幕区,将源语言和目标语言都设为字幕所用语言、然后选择配音类型和角色,开始执行
    【为字幕创建配音】将本地的字幕文件拖拽到右侧字幕编辑器,然后选择目标语言、配音类型和角色,将生成配音后的音频文件到目标文件夹
    【音视频识别文字】将视频或音频拖拽到识别窗口,将识别出文字并导出为srt字幕格式
    【将文字合成语音】将一段文字或者字幕,使用指定的配音角色生成配音
    【从视频分离音频】将视频文件分离为音频文件和无声视频
    【音视频字幕合并】音频文件、视频文件、字幕文件合并为一个视频文件
    【音视频格式转换】各种格式之间的相互转换
    【文字字幕翻译】将文字或srt字幕文件翻译为其他语言
    【人声背景乐分离】将视频中的人声和背景音乐分别分离出来,生成2个音频文件
    【下载油管视频】可从youtube上下载视频

    https://github.com/jianchang512/pyvideotrans GitHub - jianchang512/pyvideotrans: Translate the video from one language to another and embed dubbing & subtitles.

  3. Open Assistant API 是一个开源自托管的 AI 智能助手 API,兼容 OpenAI 官方接口, 可以直接使用 OpenAI 官方的 Client 构建 LLM 应用

    Open Assistant API 是一个开源自托管的 AI 智能助手 API,兼容 OpenAI 官方接口, 可以直接使用 OpenAI 官方的 Client 构建 LLM 应用。

    支持 One API 可以用其接入更多商业和私有模型。

    https://github.com/Tuanzi1015/open-assistant-api/blob/main/README_CN.md open-assistant-api/README_CN.md at main · Tuanzi1015/open-assistant-api

  4. Puter 概览 🌟Puter 是一个**开源桌面环境**,它在浏览器中运行,提供了一系列丰富的功能

    Puter 概览 🌟

    Puter 是一个**开源桌面环境**,它在浏览器中运行,提供了一系列丰富的功能。这个环境以其**速度快**和**高度可扩展**性著称,旨在为用户提供一个隐私保护的个人云服务。Puter 允许用户将文件、应用和游戏存储在一个安全的位置,随时随地都能访问。

    **主要用途**:
    1. **云存储服务**:作为 Dropbox、Google Drive、OneDrive 的高级替代品,Puter 提供了一个用户友好的界面和增强的功能。
    2. **远程桌面环境**:适用于服务器和工作站,便于远程访问和管理。
    3. **Web 开发平台**:可以用于构建和托管网站、Web 应用和游戏。
    4. **学习社区**:Puter 还是一个开放的项目和社区,适合那些有兴趣学习 Web 开发、云计算和分布式系统等领域的人。

    **资源链接**:
    - GitHub 项目页:[HeyPuter/puter](https://github.com/HeyPuter/puter)
    - 官方网站:[Puter.com](https://puter.com/)
    - 开发文档:[Puter.js 文档](https://docs.puter.com/)

    Puter 不仅仅是一个技术产品,它还致力于建立一个友好的开源社区,鼓励用户和开发者学习和分享新知。 GitHub - HeyPuter/puter: 🌐 The Internet Computer! Free, Open-Source, and Self-Hostable.

  5. 快手也发布了一个通过拖动锚点控制视频物体和镜头运动的项目DragAnything

    快手也发布了一个通过拖动锚点控制视频物体和镜头运动的项目DragAnything。

    与现有的运动控制技术相比,DragAnything 有几个显着的优势:

    首先,基于轨迹的操作方式对用户更友好,尤其是在获取其他辅助信号(如遮罩、深度图等)较为繁琐时。用户只需在互动中绘制一条线(即轨迹)即可。

    其次,我们的实体识别技术能够处理任何对象,这意味着它可以控制包括背景在内的各种实体的运动。

    最后,这种实体识别技术还可以同时对多个对象实现不同的运动控制。

    大量实验表明,我们的技术在 FVD、FID 和用户体验研究方面均达到了行业领先水平,特别是在对象运动控制方面,我们的方法比之前的技术(例如 DragNUWA)在人类评估中提高了 26%。

    项目地址:https://weijiawu.github.io/draganything_page/

  6. 本文介绍了如何使用LLM IDE(Dify)快速搭建模型应用,并使用超长上下文的200K模型完成电子书翻译

    本文介绍了如何使用LLM IDE(Dify)快速搭建模型应用,并使用超长上下文的200K模型完成电子书翻译。作者通过准备工具、获取电子书、启动Dify IDE和配置零一万物模型等步骤,详细阐述了整个翻译过程。最后,作者提到配置模型翻译应用并开始进行翻译工作。整篇文章旨在为读者提供一个高效、便捷的电子书翻译方案。

    https://soulteary.com/2024/03/13/use-yi-34b-chat-200k-model-and-dify-to-quickly-build-model-application.html

  7. Dify 是一个 LLM 应用开发平台,已经有超过 10 万个应用基于 Dify.AI 构建

    Dify 是一个 LLM 应用开发平台,已经有超过 10 万个应用基于 Dify.AI 构建。它融合了 Backend as Service 和 LLMOps 的理念,涵盖了构建生成式 AI 原生应用所需的核心技术栈,包括一个内置 RAG 引擎。使用 Dify,你可以基于任何模型自部署类似 Assistants API 和 GPTs 的能力。

    https://github.com/langgenius/dify/blob/main/README_CN.md

  8. 适用于 10 多个 AI 平台的一体化 CLI 工具,包括 OpenAI、Gemini、Claude、Mistral、LocalAI、Ollama、VertexAI、Ernie、Qianwen...

    适用于 10 多个 AI 平台的一体化 CLI 工具,包括 OpenAI、Gemini、Claude、Mistral、LocalAI、Ollama、VertexAI、Ernie、Qianwen...

    https://github.com/sigoden/aichat/ GitHub - sigoden/aichat: All-in-one LLM CLI tool featuring Shell Assistant, Chat-REPL, RAG, AI Tools & Agents, with access to OpenAI…