AI 相关 · 2025
「AI 相关」栏目 2025 年汇总,共 43 期
第 379 期:《硅谷钢铁侠》摘录
1、Chaterm

带有 AI 功能的智能终端工具,可以用自然语言完成命令行操作。(@zhouyu123666 投稿)
2、miniCC

网友开发的 AI 编程工具 Claude Code 替代品,主要用于学习目的。(@Disdjj 投稿)

一个开源的纯前端应用,通过 AI 翻译安卓资源文件,支持多语言同步、差异校验。(@huanfeng 投稿)
4、octopus

个人用户的大模型 API 聚合工具,支持接入多个模型供应商,提供负载均衡、分组名称、使用量统计等功能。(@bestruirui 投稿)
5、Vexor

一个 Python 工具,对当前目录的文件进行向量嵌入,用来语义搜索。(@scarletkc 投稿)
6、Tada

开源的任务管理应用,带有 AI 总结功能。(@Leaomato 投稿)
第 378 期:预测是新的互联网热点
1、Disco

谷歌实验室推出的实验性 AI 浏览器,完全跳过网页搜索,目前需要排队等待名额。
2、Flowers

开源的浏览器 AI 助手插件,提供网页翻译、问答、笔记等功能。(@snailfrying 投稿)

开源的代码审计平台,通过智能体实现漏洞挖掘和自动化沙箱 PoC 验证,支持 ollama 私有部署模型,代码可不出内网。(@lintsinghua 投稿)
第 377 期:14万美元的贫困线

面向小朋友的英语阅读学习工具,通过 AI 生成个性化英语故事,提供文本朗读和单词高亮。(@xckevin 投稿)

通过自然语言命令,生成并修改 draw.io 流程图的网页应用,代码开源。(@DayuanJiang 投稿)

一个需要自搭建的后台服务,从网上抓取 AI 相关新闻,并发送摘要邮件,整个过程都由 AI 完成,需要安装 Claude Code。(@wjcwjc77 投稿)

桌面端的笔记软件,支持 Windows 和 Mac,带有 AI 助手。(@blueberrycongee 投稿)

使用小米 AI 眼镜,在 20 步内还原任何三阶魔方,原理是识别魔方状态,然后算出解法,最后通过语音给出操作提示。(@idootop 投稿)
第 376 期:太空数据中心的争议

一个开源的 Web 应用,通过 Gemini 模型,将小红书和 B 站视频转成手绘故事。(@RanFeng 投稿)

一个开源的浏览器插件,收集 Nano Banana 模型的热门提示词,方便复用。(@glidea 投稿)

这个工具使用 AI 改写以前的 git 提交信息,让其变得更准确详细。
第 375 期:一扇门的 Bug

一个开源的 Web 应用,用户上传账单,它会用 AI 进行识别和财务分析。(@JasonRobertDestiny 投稿)
2、KoalaQA

开源的 AI 客服系统,可以搭建问答平台、开发者社区、用户服务社区。(@Trc0g 投稿)
3、seekdb

OceanBase 团队推出的一款开源 AI 数据库,支持向量计算,兼容 MySQL。(@liboyang0730 投稿)
4、OPENUGC

一个 AI 网页客户端,可以配置模型、Agent 和 MCP,功能较全,但是不开源。(@aicu-icu 投稿)
第 374 期:6GHz 的问题

谷歌本周发布的 IDE 产品,用于 AI 编程,也是基于 VS Code。

谷歌新发布的服务,使用 Gemini 模型为代码库生成文档。

使用 Rust 语言重写的 Open WebUI,降低了内存和资源消耗,有服务器版和桌面版。(@xxnuo 投稿)
一个命令行工具,可以对同一个任务循环运行 Claude Code,允许指定运行次数。
第 373 期:数据模型是新产品的核心
1、Davia

这个开源工具使用 AI 将代码库变成一份可视化文档。
2、VoidMuse

一个学习目录的 AI 插件,支持 IDEA 和 VS Code,代码开源,用于这类 AI 编程助手的开发教学。(@voidmuse-dev 投稿)
3、UPage

基于大模型的可视化网页构建平台,Lovable 的开源替代。(@wan92hen 投稿)
一个开源的浏览器插件,用来翻译网页,可以配置翻译服务提供商或 AI 模型。(@Cookee24 投稿)

开源的 Web 应用,为多模态大模型构建训练数据。(@599yongyang 投稿)

开源的 AI CRM 系统(客户关系管理系统)。(@maninhill 投稿)
第 372 期:软件界面如何设计
1、Jta
开源命令行工具,使用 AI 模型,翻译 JSON 文件,主要用于语言包的翻译,支持27种语言,功能较多。(@hikanner 投稿)

手绘程序 Excalidraw 的 AI 版,使用自然语言让 AI 生成手绘风格的示意图,在线试用。(@liujuntao123 投稿)

一个开源 Web 应用,生成多说话人的合成语音,具备声音克隆功能。(@zhao-kun 投稿)
一个用于教学的 AI 编程助手,旨在帮助你理解这类工具是如何开发出来的。(@minmaxflow 投稿)
5、SQLBot

一个开源 Web 服务,只要配置大模型和数据源,就可以用自然语言查询数据源,实现 text2sql。(@maninhill 投稿)

一个 Python 写的 Web 工具,通过 AI 模型翻译各种格式的文档文件。(@xunbu 投稿)

一个开源的 Web 服务,使用 AI 处理文献,提供文档翻译、智能对话、高效阅读。(@Feather-2 投稿)
第 371 期:一个乐观主义者的专访
1、Macaify

一个 macOS 开源应用,可以在任何 App 里选中文本,按下快捷键,通过大模型完成翻译、润色、改写、总结等操作。(@s1ntoneli 投稿)
2、Dayflow

开源的 macOS 桌面应用,可以生成电脑屏幕一天的时间占用。它每秒截一次屏,然后交给 AI 分析,生成你一天活动的时间线。

这个网站可以将 GitHub 仓库转换成一本电子书,适合用来训练大模型。
第 370 期:正确的代码高亮
1、AICrop

使用 AI 模型裁剪图片的免费网页工具,自动生成适合不同社媒平台(如 Instagram、X/Twitter、TikTok)的图片。(@indielucas 投稿)

免费的文生图网站,不需要注册,据说是作者用自己的几台 4090 搭建的,用的是千问模型。(@rustflare 投稿)

大模型驱动的代码审计平台,为开发者提供代码质量分析和审查服务。(@lintsinghua 投稿)

著名开发者 Simon Willison 使用 AI 生成的代码行数统计网站,分析一个项目到底有多少行代码,评估开发时间,参见介绍文章。
5、播客生成器(Podcast Generator)

开源的文本转播客工具,需要 OpenAI 密钥。(@justlovemaki 投稿)
6、MuseBot

一个接入聊天软件的智能机器人,实现了 AI 对话与智能回复,支持多种大模型,可以接入 Telegram、飞书、钉钉、微信等平台。(@yincongcyincong 投稿)
第 369 期:Tim 与罗永浩的对谈
1、nanochat

著名 AI 科学家安德烈·卡帕斯(Andrej Karpathy)本周推出的 AI 教学模型,演示 ChatGPT 的原理。你只需花费100美元租用 GPU 训练,就能自己训练出一个类似于 GPT-2 生成能力的可用模型。
2、DeepChat

基于 Vue 的桌面 AI 客户端,支持各类主流 AI 模型。(@zerob13 投稿)

一个开源的安卓应用,使用 AI 总结视频(YouTube、BiliBili)、文章、图像和文档。(@kid1412621 投稿)
第 368 期:不要这样管理软件团队

GitHub 发布 Copilot 的命令行版本。
很多 AI 模型有 VS Code 编辑器插件,这个工具可以让 VS Code 把这些模型暴露出来,提供 API 调用。

AI 统一调用工具 Ollama 开放了网络搜索 API,你可以自己编程,通过它进行 web 搜索。

免费 AI 对话网站,无需登录,直接使用,目前提供主要的一些免费模型。(@yvonuk 投稿)
5、AxonHub

开源的 AI 网关应用,为不同的 AI 模型提供统一的 API 兼容层,配备 Web 控制面板。(@looplj 投稿)

开源的浏览器插件,为浏览器接入 AI,可以替代 ChatGPT 插件,支持本地模型。(@xukecheng 投稿)
第 367 期:Nano Banana 的几个妙用
1、Huxe

个人语音伴侣,生成类似播客的“每日简报”,供你收听,内容包括当日新闻、兴趣爱好、个人日历和邮件等。
它来自 NotebookLM 的主创人员,他们离开谷歌后的创业产品。目前免费使用,参见介绍文章。
2、AIPex

周刊以前介绍过的一个开源 Chrome 插件,功能现在扩展了,可以通过 AI 进行浏览器自动化。(@buttercannfly 投稿)
3、binglish

一个 Python 脚本,自动为 Windows 更换必应 Bing 每日壁纸,并在壁纸上添加“每日单词”,AI 生成单词解释和例句。(@klemperer 投稿)
网友基于 B 站开源的 Index-TTS 语音合成模型的微调模型,提升语音的韵律感和自然度。(@asr-pub 投稿)
5、Neovate

基于终端的智能编码助手(Code Agent),可以看作是开源的 Claude Code。(@xierenyuan 投稿)

一个基于 Web 的 AI 视频字幕编辑工具,可以视频语音自动转文本,生成字幕,试用 Demo。(@x007xyz 投稿)
7、mcpstore

一个 MCP 服务的管理工具,接入各种 MCP 服务器,自带 Web 管理面板。(@whillhill 投稿)
第 366 期:旧金山疯狂的 AI 广告
1、SSHLLM

基于 SSH 的 AI 客户端,先用 ssh 登录到服务器,然后通过它使用 AI 大模型。(@aicu-icu 投稿)

免费将 PDF 文件转成一段讲解视频,配上动画和语音。(@icaohongyuan 投稿)

这个库允许使用 MQTT 协议接入 MCP 服务器,方便 AI 直接操作物联网设备。(@ysfscream 投稿)

一个开源的前端应用,使用自然语言生成网站 UI,类似于 V0/Lovable。
第 365 期:流量变现正在崩塌

一个 Python 库,向文件添加元信息,主要用来标识 AI 生成内容,符合新颁布的《人工智能生成合成内容标识办法》。(@ihmily 投稿)

免费的 AI 语音输入法,支持 Mac 和 Windows,5 个免费语音识别引擎可选。(@oldcai 投稿)
3、小红书 MCP
网友写的 MCP 服务器,可以通过 AI 在小红书发帖、获取推荐列表、搜索内容。(@xpzouying 投稿)
4、如何自己打造一个微型大模型(英文)

开源电子书,介绍大模型基础知识,教你怎么打造一个微型大模型(以 Qwen 大模型为例)。
第 364 期:最难还原的魔方

这个 Web 应用可以按章节拆分电子书(epub 和 pdf 格式),通过 AI 生成该章的文字总结和思维导图,需要用户提供大模型 API Key。(@SSShooter 投稿)
2、VIVY

文生图模型 Stable Diffusion 的桌面客户端。(@surunzi 投稿)
3、ApeRAG

开源的 RAG(检索增强生成)平台,将图谱 RAG、向量搜索和全文搜索与 AI 代理相结合。(@earayu 投稿)

AI 视频转录&翻译&总结工具,支持YouTube、Tiktok、B 站等30+平台。代码开源,需要自己搭建前后端。(@wendy7756 投稿)
第 363 期:最好懂的神经网络解释
1、DeepWiki

这个网站把任意 GitHub 仓库,变成一个 Wiki,详细解释代码运行过程,阅读代码的好帮手,参见教程。

一个 GitHub Actions 模版,用来为指定仓库的代码提交,生成每日的总结报告,发送到飞书。(@nanbingxyz 投稿)

开源的浏览器插件,使用 AI 自动识别和跳过 B 站视频里面插入的广告片段。(@Warma10032 投稿)
第 362 期:GitHub 工程师谈系统设计

OpenAI 的官方项目,展示 AI 的发展历程:每一年,同样的提示语,不一样的输出。

这个 Web 应用可以用作 MCP 客户端,指定 AI 模型和 MCP 服务器,在线使用。(@mcpexplorer 投稿)

基于终端的 AI 编码代理,Claude Code 的开源替代品。(@Blushyes 投稿)
4、Claude Code Status Bar Monitor

Claude Code 的插件,实时显示使用量和重置时间等信息。(@leeguooooo 投稿)
第 361 期:暗网 Tor 安全吗?
将提问直接附在 URL 后面,对大模型提问,比如 818233.xyz/你是什么模型 。(@yvonuk 投稿)
2、AI Short Video Factory(短视频工厂)

一个开源的 Web 应用,上传视频素材,给出提示词,AI 自动生成短视频和文案。(@YILS-LIN 投稿)

AI 地图,用户搜索一个主题,它会显示相关地图和解释文章,比如苏东坡的地图。(@klemperer 投稿)

第 360 期:Dan Wang 的新书
一个 JS 库,为 AI 操作设置费用限额,超出就中断进程。
2、Hyprnote

本地的 AI 会议助手,监听线上会议,自动生成会议笔记和总结。

一个 25MB 大小的 AI 语音模型,用来从文本生成语音。只使用个人电脑 CPU,几分钟就安装完毕,通过 Python 脚本使用,好像不支持中文,参见教程。

用 AI 管理你的 GitHub Stars,自动对项目进行分类,支持自然语言搜索。(@AmintaCCCP 投稿)
5、Snippai

跨平台的 AI 智能截图工具,可以识别并提取公式、表格、代码、图片和文字。(@xyTom 投稿)
第 359 期:Palantir 值得关注
1、LandPPT

自搭建的 PPT 生成平台,支持多种 AI 模型,将文档内容转换为 PPT。(@sligter 投稿)
2、简历警察
AI 开发平台 Dify 的插件,让 AI 修改简历,具体的修改点可以参考它的提示词。(@Disdjj 投稿)

免费的翻译站点,让 AI 翻译文档,可以保留格式,支持 PDF/PPTX/EPUB/DOCX 等多种文件(@K8S666 投稿)

免费在线 AI 工具,用于修改润色文章。(@oil-oil 投稿)
这个工具将 Google Gemini CLI 和 Kiro 客户端封装为本地 API 服务,提供 OpenAI 兼容接口,方便调用。(@justlovemaki 投稿)

Windows 文件搜索工具 Everything 的 AI 搜索客户端。(@MaskerPRC 投稿)
7、AIpex

Chrome 的开源插件,使用 AI 一键整理标签页。(@buttercannfly 投稿)
第 358 期:如何拯救一家濒临倒闭的创业公司
1、怼怼侠

一个 AI 文字玩具网站,只需输入对方说的话,AI 自动生成优雅还击的句子。(@yuandongzhong 投稿)

VS Code/Cursor 的开源插件,统一管理 AI 提示词,支持分类、搜索、导入导出。(@yuki-node 投稿)
另有一个开源应用 Prompt Shelf,通过 Web 界面,对提示词进行版本管理,可以比对差异和回滚。(@newdee 投稿)

开源的 VS Code 插件,自动生成提交说明。(@littleCareless 投稿)
4、Lumma

一个基于 Flutter 的手机应用,通过跟 AI 问答和聊天,自动生成日记。(@geosmart 投稿)
第 357 期:稳定币的博弈

一个使用 AI 模型,对 epub 电子书进行双语翻译的 Python 库。(@BlackHole1 投稿)
2、PoPo

一个很有意思的开源应用,使用自然语言发出指令(“弯腰”、“大笑”等等),控制网页上的 3D 模型人,在线试用。(@AmyangXYZ 投稿)
第 356 期:公司强推 AI 编程,我该怎么办
1、OpenCode

一个 AI 终端客户端,可以在命令行向大模型发出指令,操作文件等,类似于 Claude Code,但是开源且不限定大模型种类。
Chrome 浏览器从138版后,内置了 Gemini Nano 模型,并提供 AI Prompt API 以便调用。
这个库就是浏览器 AI Prompt API 的封装,用起来更方便。
3、TouchFS

一个很有创意的 AI 命令行工具,用它加载目录后,直接输入文件名,就能自动生成想要的文件。比如,输入touch README.md,就会自动生成自述文件。
4、yutu
YouTube 的非官方 MCP 服务器,AI 智能体接入后,就能用自然语言操作 YouTube。(@OpenWaygate 投稿)
5、Pointer

一个 AI 聊天的桌面客户端,可以使用文件夹管理聊天记录,支持全文搜索和交叉表分析。(@experdot 投稿)
6、TTS Omni

免费的文本转语音网站,基于 Qwen-TTS。(@CurioChen77 投稿)
第 355 期:两本《芯片战争》

微软开源了 VS Code 的 GitHub Copilot Chat 插件,用来跟 AI 对话。据说,GitHub Copilot 本体(主要完成代码补全和生成)很快也会开源。
2、CAPTCHA-automatic-recognition

一个油猴脚本,通过 AI 自动识别填充网页验证码。(@ezyshu 投稿)
第 354 期:8000mAh 手机电池,说明了什么?

谷歌推出的基于终端的 AI 客户端,可以完成各种 AI 操作,包括调用谷歌的视频模型 Veo 和图像模型 Imagen。
此前,其他 AI 公司已经发布了类似的命令行产品,比如 Claude Code 和 OpenAI Codex (CLI)。
2、Twocast

真人 AI 播客生成器,一键生成 3~5 分钟播客,支持多语言、多音色,免费开源。(@panyanyany 投稿)
3、Duck.ai

DuckDuckGo 推出的免费 AI 聊天服务,强调保护用户隐私。
第 352 期:Bug 追踪系统的正确样子

一个 Chrome 的 AI 插件,输入你对当前网页的修改描述,它自动将改好的网页呈现在浏览器里,需要 Anthropic API。
2、壁响(WallEcho)

根据输入的文本,免费生成手机或电脑桌布。(@twjiem 投稿)
3、AI 洞察日报

通过 Cloudflare Workers 抓取指定数据源,生成每日精选的 AI 日报,效果预览。(@justlovemaki 投稿)
4、zenfeed

智能信息助手,对于关注的新闻或话题,使用 AI 自动收集、筛选出要看的文章,并总结内容。(@glidea 投稿)
AI 模型接入这个 MCP,就可以将排版好的内容,自动发布到微信公众号,参见介绍文章。(@caol64 投稿)
第 351 期:GitHub Issues(几乎)是最好的笔记应用

谷歌新发布的安卓 App,允许用户在手机运行 Hugging Face 上面的开源 AI 模型,即它可以让手机运行本地 AI 模型。

微软旗下的 Bing 搜索引擎,加入了视频生成功能,可以使用自然语言生成免费视频,使用的是 OpenAI 的文生视频模型 Sora。
该功能目前只在 Bing 的手机 App 上开放。
3、AIDocGenius(智能文档助手)
一个 Python 脚本,集成了 AI 文档摘要、翻译、分析和格式转换。(@jiangmuran 投稿)

免费、免注册的换发型、发色的 AI 工具。(@twjiem 投稿)

AI 驱动的 epub 阅读助手,通过 AI 分析书里的句子,在线试用。(@WindChimeEcho 投稿)
6、TEN VAD

一个轻量级 AI 模型,检测音频帧中是否存在人声。(@bluemotional 投稿)
第 350 期:Java 三十周年

将文本转为 Mermaid 格式的可视化图表,省去手动编写 Mermaid 代码。(@liujuntao123 投稿)

一个与代码库对话的 Web 应用,可以扫描本地文件夹,对其建立本地索引,从而用自然语言库对话。(@oldjs 投稿)
3、Ainee

AI 开源笔记工具,将音频、文字、文件以及 YouTube 视频等转换为笔记。(@luyu0279 投稿)

开源的 AI 运维助手,对线上系统提供 AI管家,与真人协同处理运维问题。(@csunny 投稿)
第 349 期:神经网络算法的发明者
1、aTrain

一个跨平台、图形界面的自动语音识别工具,基于 Whisper 模型,支持识别50多种语言,参见介绍文章。

在线的免费图像处理工具,提供多种 AI 功能,比如图片增强、去除水印、风格转换等十几种。(@worminone 投稿)
第 348 期:李飞飞,从移民到 AI 明星

开源的 AI 应用,自动完成数学建模,生成一份完整的论文。(@jihe520 投稿)
基于本地大模型的 Bilibili 弹幕过滤器,对弹幕分类过滤。(@ddddng 投稿)
3、AI 语音克隆

免费的语音克隆工具,3 秒录音克隆人声。(@xiaodaidai0701 投稿)
第 346 期:未来就是永恒感的丧失
1、chatlog

用 AI 处理微信本地聊天记录的工具。(@sjzar 投稿)
一个 MCP 服务器,提供中文菜谱、餐食规划。(@worryzyy 投稿)

字节推出的 JS 工具,最新功能是通过 AI 和 adb,完成安卓手机自动化。它早先已经可以浏览器自动化。(@yuyutaotao 投稿)

一个 Go 语言写的网关服务,将已有的 API 转成 MCP 服务,无需改动任何代码。(@iFurySt 投稿)
第 345 期:HDMI 2.2 影音可能到头了
1、PureChat

开源的 AI 聊天应用,可以接入 OpenAI、Ollama、DeepSeek 等大模型,基于 Vue3 和 Vite5 开发。(@Hyk260 投稿)
2、Vanna

一个开源的数据库分析 AI,用自然语言向数据库询问,它会自己生成 SQL,并给出运行结果。(@904192063 投稿)

将任意视频/音频,转化为各种风格的文章,可在本地部署。(@hanshuaikang 投稿)
第 344 期:制造业正在“零工化”

一个开源的 Chrome 插件,基于 AI 大模型,使用自然语言操纵浏览器,可以看作 OpenAI Operator 的替代品。(@chandlerq 投稿)
类似的工具还有 Browser use,它是一个 Python 库,通过 AI 操作无头浏览器 Playwright,完成 UI 自动化。

2、CMDLLM
一个开源工具,可以为任何命令行工具引入大模型,比如在 Docker 命令行里面,用自然语言进行操作 Docker。(@yexia553 投稿)

一个开源应用,通过 AI 模型,将自然语言转成 SQL 语言。(@zhangchenchen 投稿)
4、QwQ AI

一个在网页界面,聚合免费 AI 模型的网站。(@sing1ee 投稿)
5、MCPFlow

MCP 的一个目录站。(@mcpflow 投稿)
第 343 期:如何阻止 AI 爬虫
开源的 AI 应用,根据文字描述和图片生成网页,使用 Claude AI 模型,部署在 Cloudflare worker。(@mggger 投稿)

开源的 AI 数字人生成工具。(@modstart 投稿)

免费的 AI 挡脸工具,将脸部替换成 Emoji 符号。(@Takea-nap 投稿)

AI 模型翻译字幕文件的免费网站。(@LetheTK 投稿)
第 342 期:面试的 AI 作弊——用数字人去面试
1、SVG 秀

根据文字描述,生成 SVG 图片,并可以编辑,代码开源(前端和后端)。(@chaseFunny 投稿)

基于大模型的 PDF 转 Markdown 工具,实现文档结构化转换。(@jorben 投稿)
3、We0

通过 AI 生成应用程序,支持后端生成和前端生成,还可以 Sketch/Figma 设计稿1:1还原,代码开源。(@Mashiro2000 投稿)

使用自然语言,搜索 GitHub 仓库。(@xgzlucario 投稿)

开源的 AI 提示词优化工具。(@linshenkx 投稿)

Bob(macOS 平台的翻译软件)的一个插件,引入本地翻译服务器 MTranServer。(@gray0128 投稿)
第 341 期:低代码编程,恐怕不会成功
上周,Mistral AI 发布了号称史上最强的 OCR 识别工具,具有公式和表格的识别能力,参见介绍文章。


著名程序员 Simon Willison 开源了一个 Python 脚本,演示了怎样调用 Mistral 的 API 进行文字识别,参考他的文章。
2、Free QWQ

免费、无限制的算力平台,为开发者提供 QwQ 32B 大语言模型 API。(@nexmoe 投稿)

使用大模型对 GitLab 项目进行 Code review 的工具。(@mimo-x 投稿)
4、人话翻译器
一个 Chrome 插件,通过 AI 将难懂的中文翻译成好懂的中文。(@DemoJ 投稿)
第 340 期:技术炒作三十年
1、olmOCR

一个使用 AI 模型进行文字识别(OCR)的 Python 工具。
2、Probly

一个基于 AI 的电子表格软件,可以在浏览器中对表格运行 Python 代码。

每天自动抓取 Hacker News 热门文章,通过 AI 生成中文播客。(@Y024 投稿)
4、语析

基于大模型,进行知识库管理与生成知识图谱的工具。(@xerrors 投稿)

西北工业大学 ASLP 实验室开发的一个 AI 音乐生成模型。(@JoeDeanx 投稿)
第 337 期:互联网创业几乎没了

一个开源的 AI 桌面应用,可以上传文档,生成本地的知识库问答系统,基于 RAG(检索增强生成)技术。(@JohannLai 投稿)

一个 AI 的工具框架,快速打造语音相关的 AI 应用。(@SyunWong 投稿)
3、We0

开源的 AI 代码生成方案,对标Cursor。(@we0-dev 投稿)

一个开源的谷歌 Gemini Pro 手机客户端,基于 React Native。(@bravekingzhang 投稿)
5、Ncurator(馆长)

一个浏览器插件,通过导入文件或者爬取网页,建立自己的知识库,与内容聊天。(@Yoan98 投稿)
6、LLMs-Zero-to-Hero,完全从零手写大模型(视频)

网友投稿的一个视频,用一小时讲解从数据处理到模型训练,理解算法原理。(@bbruceyuan 投稿)

结合 OCR + LLM 的文档信息免费提取工具,适合处理发票、收据、简历等。(@hr98w 投稿)
8、AI 头像生成器

免费的头像合成网站。(@lyqtzs 投稿)
第 336 期:面对 AI,互联网正在衰落

开源的全功能 AI 大模型客户端,自带 Web UI。(@NitroRCr 投稿)
一个 Go 语言程序,使用 AI 模型,将语音文件转成文字稿。

AI 语音工具,具有多种功能(语音识别、翻译、语音克隆、文本转语音),属于 Whisper 模型的 Web UI。

该网站可以输入一个 Hacker News 论坛的用户名,它会用 DeepSeek 模型总结该用户的特点,描述非常准确而且传神。
5、GenSFX

免费的 AI 音效生成网站。(@andylearnai 投稿)
6、福琪写春联

免费的 AI 春联生成工具。(@itfoxnet 投稿)
第 334 期:年终笔记四则

基于 Flux.1-DEV 模型的 AI 图像生成网站,免费、无使用量限制、不需要注册。(@markliuyuxiang 投稿)

Chrome 浏览器扩展,一键查询不同 AI 。(@taoAIGC 投稿)

将播客或音频转录成文本,并给出摘要,基于 Next.js 和 OpenAI Whisper,代码开源。(@winterfx 投稿)
4、Get Your Perfect Chinese Name

AI 给外国人起中文名字。(@syhdeclan 投稿)
第 333 期:一切都要支付两次
基于视觉大模型的开源 OCR 文字识别工具,自带 Web 前端。(@dwqs 投稿)
另有一个类似的项目,基于 Gemini 的 OCR 识别。(@cokice 投稿)


开源的浏览器插件,直接在网页上与 DeepSeek 大模型互动,获取选中文本的总结或解答。(@DeepLifeStudio 投稿)
3、AI 生成涂色书

输入关键词,生成免费的涂色书。(@meetqy 投稿)

Minecraft 与 AI 相结合,打造实时响应、动态生成的开放世界游戏。(@boqiwen 投稿)

Chrome 浏览器插件,收藏网页时,自动生成相关标签,无需手动归类。(@howoii 投稿)
6、AnyVoice

AI 声音克隆,只需3秒音频就可创建逼真的声音克隆。(@markliuyuxiang 投稿)
第 332 期:西蒙·威利森的年终总结,梁文锋的访谈

根据提示生成 App,基于 DeepSeek V3 模型。(@sing1ee 投稿)
2、GodView

语义化地图,用自然语言查询地图,比如输入“请展示上海的前10大图书馆”。
3、对话 CEO

与马斯克、张一鸣、任正非对话,效果还可以。(@5A59 投稿)
4、ithy

AI 模型聚合网站,输入关键词,同时返回 Lllma 3.1、o1-mini、Sonnet 3.5、Grok 2、Gemini 1.5 pro 的生成结果。
开源的 Chrome 浏览器插件,将鼠标操作通过 AI 转为 Selenium Python 脚本,需要 OpenAI key。(@guoriyue 投稿)