微软官方出的AI入门课程,完全免费开源,60000+星标。
12周,24课,从零基础到能看懂主流AI概念。 配套Jupyter Notebook,边看边跑代码,不是纯看PPT那种。 想系统学AI又不知道从哪开始的,这个可以当第一站。
别再让 Agent 死等 OCR。
Firecrawl 开源 pdf-inspector: - 20ms 级分类 - 直接抽 Markdown - 200 份约 2.8 秒 - Rust,表格图表友好 Agent 读文档,终于不那么卡。
别急着给 AI avatar 交月费。
开源已经能做到: 一张照片 + 一段音频 = 会说话的视频。 免费,自己架。 平台卖的,本质就是这个。 仓库链接在 reply。
AI 写代码已经很快了。
还烦人的是:App 截图、上架、改商店文案。 做新 App 时,这三个拼起来,基本不用再手点模拟器: 1. mobile-mcp:让 agent 直接操作模拟器截图 2. app-store-screenshots:快速出商店截图 3. asccli.sh(iOS):命令行管 App Store Connect 开发加速只是一半。 上架流水线自动化,才是另一半。
YouTube Premium 真正值钱的,很多人只是「去广告 + 后台播放」。
开源前端 Invidious 把这两点(以及免登录、少追踪)做了,还去掉自动播放和算法投喂。浏览器直接开,公共实例能用,也支持自己架。 不是完美替代全家桶,但对「只想安静看完一支片」够用了。链接在下一条。
别先慌「被黑了」——先搞清楚:你的常用昵称,公开暴露在哪些平台。
Sherlock 就是干这个的:输入一个 username,批量扫社交网络是否存在同名号。GitHub 星很多,本质是 OSINT 枚举,不是攻击工具。 想查自己的数字足迹,从这里开始够了。
不想给 Burp Suite Pro 付订阅,又想正经拦流量改包?
试试 Hetty:开源 MITM 代理,专给安全研究和漏洞赏金。拦截落盘、实时改响应、Sender 手改请求、项目库管 Scope,Web UI 开箱即用。 跨平台 Go 二进制,本地跑完事。链接在下一条。
很多人职业焦虑不是懒,是不知道自己到底强在哪。
有人把「踩过风口」的思路收成 Agent Skill:不是聊一次就下结论,而是可持续更新的 HTML/飞书文档;挖能力护城河;搜岗位价值时尽量躲开二手软文;再给 90 天行动清单。彩蛋叫「大师透镜」——找处境相近的优秀样本。 你更缺兴趣地图,还是 90 天执行表?
不连 Wi-Fi、不配蓝牙,两部手机靠「屏幕闪瞎」互传文件。
开发者 Alstroph 做了 DECIMEN:发送端 60 FPS 狂闪 QR 码,每帧大约 2953 bytes;对面拿相机对着拍,边拍边解。纯光,air-gapped。 手持大概 120 KB/s,架稳能到约 186 KB/s。底下用 Fountain Codes:帧可以乱序、可以漏,攒够碎片就能拼回整文件。 不指望它替代 AirDrop。但「光当网线」这思路很干净。
Claude Code 最阴的一笔账:
5 小时额度烧完,新会话把旧对话整段重读一遍——token 费用可能比你想的狠。 claude-cache-guard 的做法简单:会话收尾写好 next_session.md,下次直接接着干,少付「重读税」。
范冰把一本二十多万字的新书免费开源了:
《前置部署工程师:人工智能时代的客户价值交付秘籍》 FDE:驻扎客户现场,把「产品能做的」和「客户需要的」接起来。 Palantir 当年在保密室里做出来的工种,如今 OpenAI 为它单独立了部署公司。 他的说法:这是 AI 时代前置位的「增长黑客」。 全书在线读,不收一分钱。
浏览器里直接盖 3D 建筑。
Pascal Editor:开源 3D 建筑编辑器 React Three Fiber + WebGPU 节点式场景:墙、板、门窗、楼层…… 不是渲染 demo,是能改能存的编辑器。 约 2 万 star。
很多人找 AI 编程工具,最后装了一堆「限制模型别乱来」的壳。
OpenPRD 反着来:强化 AI,而不是把 AI 捆住。 Codex 上到 5.6 以后,这种差别更明显——同一任务里你能直接看到「能飞」和「被卡住」。 适合已经会一点 Vibe Coding、嫌护栏太多的人。
Kimi K3 被严重低估了。大家盯跑分,真正值钱的是工作流打包:
1. Agent swarm:一次开多 agent 并行 2. Kimi Code:终端直接写代码 3. Deep research:深度研究很能打 4. Websites:约 60 秒出全端站 5. Scheduled tasks:重复任务直接排程 还有 Sheets/Docs 管理、接 OpenClaw 一类能力。一人公司要的基础设施,它在往「一条龙」凑。 我的判断:模型竞争下一段不是谁更聪明
自学 AI 最浪费时间的一步,不是读不懂,是找不到「能合法免费看」的正版教材入口。
Awesome Free AI Books 把约 30 本授权教材按主题收好:DL、RL、NLP/LLM、CV、因果推断等。 怎么用更有效: 1. 先定位缺口(数学/架构/应用),别从头硬啃 2. 优先合法免费版本,学校/公司引用不心慌 3. 深度学习入门可从 Goodfellow 那本开 收藏链接,比再囤十个「学习路线图」有用。
Buzz:在自己服务器上跑一套「Slack + GitHub」,AI agent 直接当正式成员。
13.5K ⭐,当日暴涨约 1.7K,Trending 前列。 Slack 按人头收费,免费版还限消息。Buzz 把聊天、代码、工作流搬到你自己的 relay: - 频道/私信/串聊/画布,全文可搜 - agent 独立密钥 + 审计链,权限可收口 - Git 集成,patch 以签名事件流转 - 自托管,不交席位费 想让 agent 和人共用同一频道协作,这个方向值得盯。
大多数 Prompt 资料库死在同一个地方:
文件夹里很漂亮,一碰上缺字段、脏输入、边缘 case,就跑不动。 AI-Gist 有意思的点,是把 prompt 当可复用工具:变量、Jinja 模板、版本历史、AI 辅助调优,还偏 local-first / 隐私优先。 我的验收很无聊:拿一条真实客服脏流程砸进去。字段缺失、格式混乱时它还能不能稳定产出——能,才叫工具;不能,就还是收藏夹。
从 macOS 换 Linux,我最舍不得的不是壁纸,是 Raycast。
有人做了高度复刻,还兼容插件思路:命令面板、扩展、快速动作一条龙。 桌面效率工具决定你愿不愿意长期待在某个系统上。这类项目比再来一个主题包实在。
bitchat:没网也能聊天。
手机之间靠蓝牙组网传消息,附近设备互相中继,一条消息最多跳 7 次到对面。 不用注册,不填手机号,没有中心服务器。 有网时自动走 Nostr 中继,全球也能聊。 - 蓝牙 mesh 离线直连 - Noise 协议端到端加密 - 有网可切大量中继,还能按地理位置进频道 - 三连点一键抹掉本机数据 31K+ 星,涨得很快。灾难、集会、信号差场景,这种东西突然就不「极客玩具」了。
GitHub 上又一个值得 AI 开发者收藏的项目:aisuite。
Andrew Ng 团队做的轻量层,你可以把它想成「模型万用转接头」: OpenAI、Claude、Gemini……尽量同一套代码切换。 真实痛点很土:今天接 GPT,明天换 Claude,后天测 Gemini,每家 API 细节不同,项目很快变成一堆 if-else。 aisuite 解决的不是「让模型更聪明」,是让你换模型时少重写系统。模型会一直变,架构不该每次跟着崩。
没了 giffgaff,你需要 ENC - 在家搞一个长期可用美国手机号 (2026新版)
注册 ChatGPT Plus、PayPal,或者随便一个美区 App,填手机号那一步经常卡住——它就是不认国内号码,非要一个美国号发验证码。 人在国内,不用找人代注册,自己就能搞到一个真的能收验证码的美国号。今天说的是 ENC 迎客移动这张卡:是什么、怎么买、怎么用,以及怎么让这个号长期活着又不多花钱。 先把最容易搞混的一点讲清楚:这张卡挂靠的是 T-Mobile 的网络,拿到手的是一个真实的美
你的 AI 产品,loading 画面是认真设计过,还是直接套了系统默认的转圈。
说实话大部分团队都会把这个细节跳过,可用户盯着 loading 的时间,可能占了整个使用时长的一半。 刚好看到有人把这事解决了:一个叫 Thinking Orbs 的开源库,专门做“AI 思考中”的球体动画。6 种效果、Light/Dark 双模式都支持,还有 playground 能先试效果,零依赖一行 npm 就装完。 Jakub Antalik 和 a_brinza 一起做的,视频看一眼比读
如果电脑上的操作都能交给AI代劳,你会先让它干哪件事。
微软最近给了个却意外的答案:Fara,一个专门干“操作电脑”这事的开源模型,刚更新到 1.5。 它不靠聊天工作,而是直接看屏幕截图,跟人一样去点鼠标、敲键盘,自己去填表、比价、订票、搜资料。 更打动我的一点是它能完全本地跑:LMStudio、Ollama、vLLM 直接载入 Fara-7B,MacBook M4 Pro 上跑量化版都没问题,数据不用传上云。 免费,开源,架构也换成了 Qwen3.5
多数股票分析工具只接一个模型,这个直接接入四个:Gemini、ChatGPT、DeepSeek、Claude。
Daily Stock Analysis 是个近 6 万 Star 的开源项目,自动整合行情、新闻、技术指标和基本面,让多个模型交叉分析同一支股票,生成结构化报告。 用长鑫科技举例,报告会拆解出国产替代、技术差距、IPO 估值、行业周期、潜在风险五个维度,外加乐观/中性/悲观三种情景。 支持 A 股港股美股,带 WebUI、大盘复盘、自选股、历史报告,Docker 一键本地部署。
用 Claude Code / OpenClaw 攒了一堆 skill 之后,最烦的是不知道哪个 skill 引用了哪个,改一个怕连锁炸。
刚看到一个 Obsidian 插件叫 Agent Skill Graph,把这堆 skill 关系画成图谱:自动读 SKILL.md 的 frontmatter 认节点、画引用边、按类型上色。 一眼就能看出谁依赖谁,谁是孤儿 skill。 管理 skill 从"背下来"变成"看得见",skill 数量一多这个真的有用。
想跑语音/音频类 AI,这 4 个开源项目今天就能直接用:
1. Whisper——OpenAI 的语音识别,把语音转成文字 2. F5-TTS——文本转语音,效果自然 3. Coqui TTS——另一个成熟的文本转语音方案 4. RVC——变声/音色转换,把一个人的声音换成另一个人的音色 都是开源,本地能跑,链接放在评论区。 1. Whisper: https://github.com/openai/whisper 2. F5-TTS: https://
百度网盘 - 闲鱼 MCP 一键发布,让你有价值的资料变成持续赚钱的机器
你网盘里是不是也躺着几十个 G 的资料?真正卡住你上架闲鱼的,往往不是「有没有货」,而是那套重复劳动:翻文件夹找素材、下载到本地、开闲鱼网页填标题图价格、点发布——每一件新货都要重来一遍。 这套重复劳动,够格交给 Agent 做,你只需要最后点头确认。 今天讲的就是这条链路:**百度网盘 + 闲鱼 + Agent(MCP)**。 把网盘接成工具,把闲鱼接成工具,再串成「找资料 → 写介绍 → 打草
处理长播客最亏的时间不是听,是转录——同一段音频,为了换个总结角度就要重新跑一遍语音转文字。
有个工具叫 audio-tldr 专治这个浪费:本地转录一次,文字稿直接缓存,之后想怎么换角度总结都不用再碰转录环节。 支持 Claude Code 和 Codex 直接装。还没亲自跑过,但这个只转录一次、反复复用的思路本身就值得先收藏。
学大模型最缺的不是理论,是能跟着敲代码的教程——尤其还得是中文的。
dive-into-llms 刚好补上这个空:上海交大张倬胜团队出的 11 章实战课,每章配讲义 PDF 加可执行 Notebook,从微调、提示工程讲到 RLHF、多模态、GUI agent,连越狱攻击和 agent 安全这种进阶内容都覆盖了。 GitHub 44.9K star,今天单日涨 654,说明真有人在用。 全中文,边学边改代码,不需要去看大量英文论文。
如果你的 MacBook 电池莫名掉得很快,先查查是不是装了罗技的 Logi Options。
这软件会让 CPU 长期空转、电池持续发烫,很多人根本没意识到问题出在这,我就是这么把电池干废的。 好消息是有个开源替代方案叫 Mouser,能还原大部分官方功能还不占资源,配图是我调好的 MX Master 3 按键方案,可以直接参考。