每日精粹

  1. LightPDF标语:AI驱动的PDF解决方案,让工作效率提升轻松无忧介绍:一款集成了多种功能的AI工具,可以让你与PDF文件对话、转换格式、编辑内容、进行光学字符识别(OCR)以及去除水印

    LightPDF
    标语:AI驱动的PDF解决方案,让工作效率提升轻松无忧
    介绍:一款集成了多种功能的AI工具,可以让你与PDF文件对话、转换格式、编辑内容、进行光学字符识别(OCR)以及去除水印。它在Windows、网页、Android和iOS平台上均可使用。无论是个人还是商务需求,都能轻松提升你的工作效率!
    产品网站: https://lightpdf.com/ AI-Powered Free Online PDF Editor, Converter & Reader - LightPDF

  2. Marqly 3.0标语:书签管理,颠覆传统

    Marqly 3.0
    标语:书签管理,颠覆传统。
    介绍:Marqly 是一个简单易用的工具,让你轻松在线保存、定制和管理所有书签和文本。
    产品网站: https://www.marqly.com/ Marqly — AI Bookmark Manager | Organize Smarter, Find Faster

  3. Kompad标语:一款面向技术人员的开源笔记应用介绍:Kompad是一款笔记应用,帮助用户保持组织性和高效率

    Kompad
    标语:一款面向技术人员的开源笔记应用
    介绍:Kompad是一款笔记应用,帮助用户保持组织性和高效率。它支持MacOS、Windows和Linux系统,并且能够实时同步数据,让你随时随地都能访问你的笔记。
    产品网站: https://kompad.hudy9x.com/

  4. PDFMathTranslate ​一款 PDF 翻译工具来提升阅读速度,在翻译文档的同时,保留原文档的公式、图表以及目录结构

    PDFMathTranslate ​
    一款 PDF 翻译工具来提升阅读速度,在翻译文档的同时,保留原文档的公式、图表以及目录结构
    https://github.com/Byaidu/PDFMathTranslate GitHub - PDFMathTranslate/PDFMathTranslate: [EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的…

  5. ReadPo - Markdown 海报 ​使用 Markdown 灵活的编辑,实时预览,支持导出为图片

    ReadPo - Markdown 海报 ​
    使用 Markdown 灵活的编辑,实时预览,支持导出为图片。支持多种 ReadPo 海报模板和主题。提供一个免费的海报渲染 API,可以集成到你的网站、Bot、ChatGPT、Coze 等平台
    https://readpo.com/zh/poster ReadPo

  6. Cline ​Cline 的 AI 助手,它以前叫 Claude Dev,在 OpenRouter 上表现出色

    Cline ​
    Cline 的 AI 助手,它以前叫 Claude Dev,在 OpenRouter 上表现出色。Cline 能利用命令行界面和编辑器,借助 Claude 3.5 Sonnet 的编码能力处理复杂软件开发任务。它可在用户许可下创建和编辑文件、探索大型项目、执行终端命令,并通过人在回路的图形界面确保安全。用户可添加任务和图像,让 Cline 将模型转化为功能应用或修复错误。它能分析文件结构和源代码、执行各种操作并展示结果,支持多种 API 和模型,可记录令牌和 API 使用成本。还能在终端执行命令、创建和编辑文件、分析图像和浏览器截图、添加上下文信息
    https://github.com/clinebot/cline GitHub - cline/cline: Autonomous coding agent as an SDK, IDE extension, or CLI assistant.

  7. sublink-worker ​无需服务器,一键部署,快速使用自建节点分享URL进行订阅转换,提供灵活的自定义选项,支持SingBox/Clash/V2Ray/Xray

    sublink-worker ​
    无需服务器,一键部署,快速使用自建节点分享URL进行订阅转换,提供灵活的自定义选项,支持SingBox/Clash/V2Ray/Xray
    https://sublink-worker.sageer.me/

  8. gkd ​基于无障碍,高级选择器,订阅规则的自定义屏幕点击 Android 应用 |一个 Android 应用程序,具有基于辅助功能、高级选择器和订阅规则的自定义屏幕点击

    gkd ​
    基于无障碍,高级选择器,订阅规则的自定义屏幕点击 Android 应用 |一个 Android 应用程序,具有基于辅助功能、高级选择器和订阅规则的自定义屏幕点击
    https://github.com/gkd-kit/gkd GitHub - gkd-kit/gkd: 基于无障碍,高级选择器,订阅规则的自定义屏幕点击安卓应用 | An Android APP with custom screen tapping based on Accessibility, Advanced…

  9. Upscayl ​一款免费开源的 AI 图像放大软件

    Upscayl ​
    一款免费开源的 AI 图像放大软件。它使用高级 AI 算法放大和增强低分辨率图像且不损失质量,就像魔法一样。支持 Linux、macOS 和 Windows 系统
    https://upscayl.org/ Upscayl - AI Image Upscaler

  10. LiteLLM ​将 LLM 的格式都转换为 OpenAI 的接口规范

    LiteLLM ​
    将 LLM 的格式都转换为 OpenAI 的接口规范
    https://github.com/BerriAI/litellm GitHub - BerriAI/litellm: The fastest, litest AI Gateway. Rust core with Python SDK. Call 100+ LLM APIs in OpenAI (or native) format…

  11. NotesHub一个 Markdown 笔记软件,具有插入图表、曲谱、公式等多种功能,有 Web/桌面/手机客户端,支持 Git 仓库同步

    NotesHub
    一个 Markdown 笔记软件,具有插入图表、曲谱、公式等多种功能,有 Web/桌面/手机客户端,支持 Git 仓库同步。
    https://about.noteshub.app/ NotesHub - Take Notes, Sync and Collaborate

  12. MDX Notes - 跨平台笔记软件,公众号排版编辑器MDX Notes 是一个跨平台笔记软件,也是一个微信公众号排版编辑器,使用MDX,可自定义组件、样式、生成二维码、代码 diff 高亮,可导出 markdown 和 PDF

    MDX Notes - 跨平台笔记软件,公众号排版编辑器
    MDX Notes 是一个跨平台笔记软件,也是一个微信公众号排版编辑器,使用MDX,可自定义组件、样式、生成二维码、代码 diff 高亮,可导出 markdown 和 PDF
    https://mdxnotes.com/

  13. 🆔 网站名称:PICKFREE⭐️ 网站功能:设计资源导航📁 网站简介:一个汇总各种免费资源的导航网站,提供丰富的免版权素材和在线工具

    🆔 网站名称:PICKFREE

    ⭐️ 网站功能:设计资源导航

    📁 网站简介:一个汇总各种免费资源的导航网站,提供丰富的免版权素材和在线工具。

    涵盖了免版权图片、字体、音频、视频等设计素材的下载,还提供在线生成背景、纹理、图标等功能。

    🔗 网站链接:https://www.pickfree.cn/

  14. Meta Spirit LM——混合文本和语音的开源多模态语言模型Meta Spirit LM 是 Meta AI 发布的开源多模态语言模型,能够在语音和文本之间无缝转换,有 Base 版本和 Expressive 版本

    Meta Spirit LM——混合文本和语音的开源多模态语言模型

    Meta Spirit LM 是 Meta AI 发布的开源多模态语言模型,能够在语音和文本之间无缝转换,有 Base 版本和 Expressive 版本。

    仓库地址:https://github.com/facebookresearch/spiritlm
    论文地址:https://arxiv.org/abs/2402.05755
    DEMO 演示:https://speechbot.github.io/spiritlm/

    核心功能:
    1. 基本语音转换:Base 版本可以处理语音的基本转换,适合一般的语音识别和生成任务。
    2. 情感捕捉与生成:Expressive 版本能够捕捉语音中的情感,生成带有这种情感的语音,使机器说话更加自然。
    3. 自动语音识别(ASR):将语音输入转换为文本输出。
    4. 文本转语音(TTS):将文本输入转换为语音输出。
    5. 语音与文本的混合生成:根据输入的模式自由生成文本或语音,并能够在生成过程中切换模态。
    6. 情感理解与表现力生成:SPIRIT-LM-EXPRESSIVE 版本不仅能够理解情感,还能够通过不同的音调和风格生成具有表现力的语音,如生成带有“愤怒”“悲伤”“兴奋”等情感色彩的内容。

  15. Batch Tool:免费在线 AI 图片处理神器,批量去水印/去背景/WebGPU加速/免费无限次数🌟 工具名称:Batch Tool🌐 使用环境:无需梯子🪜,无需登录🔗 工具地址:

    Batch Tool:免费在线 AI 图片处理神器,批量去水印/去背景/WebGPU加速/免费无限次数

    🌟 工具名称:Batch Tool
    🌐 使用环境:无需梯子🪜,无需登录
    🔗 工具地址:https://images.batchtool.com/zh
    🌈 官方推特:https://x.com/gucho2001827756

    Batch Tool 是一款完全免费、浏览器本地运行、性能优秀的在线 AI 图片处理工具,支持 CPU 和 WebGPU 处理,提供批量去除背景和移除物体功能。

    Batch Tool 的特点包括:
    1.简单易用:免登录、操作简单,即开即用。
    2.高性能:支持 WebGPU 加速,速度超快。
    3.高效批处理:支持一键处理多个文件。
    4.支持多语言:支持中文、英语、日语等 6 种语言。
    5.隐私优先:使用本地 AI 模型,无需上传到服务器。 Batch Tools

  16. GitHub - OpenSource-O1/Open-O1:开源项目实现 O1 级别的 AI 模型一个尝试复刻GPT-O1的开源项目🧐 Open-O1 项目旨在通过开源方式提供强大的大语言模型,以匹敌 OpenAI 的 O1 模型,侧重于复杂推理和广泛任务的处理能力

    GitHub - OpenSource-O1/Open-O1:开源项目实现 O1 级别的 AI 模型

    一个尝试复刻GPT-O1的开源项目

    🧐 Open-O1 项目旨在通过开源方式提供强大的大语言模型,以匹敌 OpenAI 的 O1 模型,侧重于复杂推理和广泛任务的处理能力。

    ➡️ 链接:https://github.com/OpenSource-O1/Open-O1

    重点

    🔍 高级推理与问题解决:Open-O1 模型基于 O1 风格的数据进行训练,展现出强大的逻辑推理和复杂问题解决能力,支持多种应用场景。

    💻 开源替代方案:该项目使用 Hugging Face 提供的 LLaMA 和 Qwen 模型,构建开源替代方案,降低企业和个人获取先进 AI 能力的成本。

    🛠 多模型与部署支持:提供 OpenO1-Qwen-7B 和 OpenO1-LLama-8B 等多个模型版本,并支持快速部署,用户可以根据需求选择合适的模型进行推理和开发。

    🌐 强大的社群支持:项目设有社区沟通渠道(如 Discord 和 Slack),并计划持续发布更新,包括奖励模型和数据、RLHF 支持等,进一步推动社区协作和开放 AI 技术的发展。 GitHub - Open-Source-O1/Open-O1

  17. eSearch:一款集截屏、OCR、搜索、翻译、贴图、屏幕翻译、以图搜图、滚动截屏、录屏等多种功能于一身的工具eSearch 支持在进行 OCR 操作后,可调用翻译功能,并且实现了跨平台支持,包括 Linux、indows 和 Mac

    eSearch:一款集截屏、OCR、搜索、翻译、贴图、屏幕翻译、以图搜图、滚动截屏、录屏等多种功能于一身的工具

    eSearch 支持在进行 OCR 操作后,可调用翻译功能,并且实现了跨平台支持,包括 Linux、indows 和 Mac。

    官方网站:https://esearch-app.netlify.app/
    仓库地址:https://github.com/xushengfeng/eSearch
    下载地址:https://esearch-app.netlify.app/#download

  18. 小报童专栏导航xiaobot101.com 超过400+ 个小报童专栏,帮助你找到想要的小报童专栏

    小报童专栏导航
    xiaobot101.com 超过400+ 个小报童专栏,帮助你找到想要的小报童专栏
    https://www.xiaobot101.com/

  19. Whisper-WebUI——基于 Whisper 的浏览器界面工具Whisper-WebUI 是一个基于 Gradio 的浏览器界面,可作为简易字幕生成器

    Whisper-WebUI——基于 Whisper 的浏览器界面工具

    Whisper-WebUI 是一个基于 Gradio 的浏览器界面,可作为简易字幕生成器。它支持多种 Whisper 实现方式,能从不同来源生成字幕,具有语音转文本翻译、文本转文本翻译等功能,还可进行音频预处理和后处理。可以通过 Pinokio、Docker 或本地运行。

    仓库地址:https://github.com/jhj0517/Whisper-WebUI

    核心功能:
    1. 多种 Whisper 实现选择:可在 openai/whisper、SYSTRAN/faster-whisper(默认)、Vaibhavs10/insanely-fast-whisper 中选择。
    2. 多源字幕生成:从文件、Youtube、麦克风等生成字幕。
    3. 支持多种字幕格式:SRT、WebVTT、txt。
    4. 语音转文本翻译:从其他语言翻译为英语。
    5. 文本转文本翻译:使用 Facebook NLLB 模型或 DeepL API 翻译字幕文件。
    6. 音频预处理:使用 Silero VAD 预处理音频输入,使用 UVR 分离 BGM。
    7. 音频后处理:使用 pyannote 模型进行说话人区分。
    8. 可通过 Pinokio、Docker 或本地运行。
    9. 根据需求调整 VRAM 使用。
    10. 支持多种 Whisper 模型。 GitHub - jhj0517/Whisper-WebUI: A Web UI for easy subtitle using whisper model.