Apache Superset 简介与上手指南——开源 BI 可视化平台
项目概述 企业里自建数据可视化平台这件事,曾经是 Tableau 或 PowerBI 的地盘,买授权、部 License Server、等 IT 审批,走一圈下来往往好几个月。Apache Superset 是另一条路:完全开源、Apache 基金会项目、自托管、支持从 PostgreSQL 到 BigQuery 再到 ClickHouse 的 70 多种数据源。 Superset 有两个主要入口。一是无代码的图表构建器:选数据源、选表、拖字段、配聚合方式,几分钟出一张图,不需要写 SQL。二是 SQL Lab,一个功能完整的浏览器内 SQL 编辑器,支持多标签查询、历史记录、结果导出,写完 SQL 直接把结果存成图表。两个入口面向不同背景的用户,但生成的图表都能放进同一个仪表板。 图表类型覆盖面很宽:折线图、柱状图、饼图、散点图、热力图、地理位置地图、日历热图……还有一个图表画廊可以直接浏览所有支持的类型。仪表板支持多图联动过滤,点击一个维度,其他图表联动刷新,这对做数据探索很有用。 权限系统是基于角色的,可以精细控制到"某个用户只能看哪几个仪表板"、“某...
PicLite 简介与上手指南——本地图片压缩 + 自建图床的开源神器
项目概述 写公众号、做 PPT、运营博客、整理素材,几乎所有人都会遇到图片难题:原图体积巨大,上传卡顿;用在线压缩工具,图片要上传第三方服务器,隐私存隐患;压缩完画质糊掉,反复调参数全靠盲猜;想要私有图床,部署又过于复杂。 PicLite 正是为解决这一痛点而生的开源工具。它同时兼顾 本地图片压缩 与 自托管私有图床 两大能力,全平台免费开源,无广告无会员,解决图片处理全链路痛点。 PicLite 的核心亮点在于:图片全部在本机完成运算,默认不上传任何外网服务器,浏览器网页版、桌面客户端均是如此,断网也能正常压缩图片。只有你主动开启图床上传功能,图片才会推送至你自己部署的服务,隐私可控,企业、个人都可以放心使用。 桌面端:强大的本地压缩工作台 连续画质滑动调节,实时预估文件大小 区别普通工具的几档固定画质,PicLite 提供连续画质滑动条(1‑100%),拖动滑块就实时预览压缩后的预估体积,直接拿捏 “画质够用,体积最小” 的平衡点,不用反复导出测试。 丰富格式支持 支持 JPG、PNG、WebP、GIF,支持 GIF 动图压缩,格式互转,清除图片元数据,添加文字水印。 批量...
CreatorHub 简介与入手指南——多平台内容管理利器
项目概述 靠跨平台搬运短视频赚十几万的案例,不少行业内人都听说过。但还在手动一条条扒视频、导素材做矩阵,纯靠人力硬肝,效率实在太低。 CreatorHub 正是为解决这一痛点而生的开源项目。它把抖音、小红书、快手、视频号整合到同一个后台面板,实现了: 批量盯博主账号,实时监控新作更新 自动采集下载素材,省去手动保存 多账号集中管理,实现跨平台分发 评论监控消息推送,还能对接通知渠道 CreatorHub 使用 Python + FastAPI 提供统一 Web 界面,用于管理账号、监控作品与评论、下载内容、发布作品和接收通知。所有账号登录态、数据库及媒体文件均保存在本地,不依赖任何第三方云服务。 浏览器交互层面,CreatorHub 按平台分别使用系统 Chrome CDP 或开源的 Patchright,业务层统一使用兼容的 Playwright API。每个账号使用独立的浏览器 Profile,Cookie、缓存和本地存储完全隔离。 平台能力对比 CreatorHub 目前支持抖音、小红书、快手和视频号四个主流平台,各平台能力覆盖程度如下: 功能...
10 个 GitHub 开源爬虫仓库学习笔记——免费爬取整个互联网
背景与触动 看到这篇文章的第一反应是很意外——很多人做数据抓取,第一反应是找付费 API,一问价格每月几百到几千美元,还得签合同。但 GitHub 上已经有人把工业级的爬虫工具开源了,能抗反爬、能处理百万页面,而且完全免费。 这个认知差很有意思。商业服务之所以能卖高价,核心在于「省事」——但当你知道有这些开源替代品存在后,花钱的理由就变薄了。 下面按照原文的分类框架,重新梳理学习笔记,加上自己的理解和思考。 AI 时代首选:Firecrawl 和 Crawl4AI Firecrawl — 全场 Star 最高的爬虫项目 基础信息: GitHub:156,060 Star 地址:github.com/firecrawl/firecrawl 原仓库在 mendableai 名下,现已迁移到独立组织 firecrawl 核心能力: 指向任意网站,返回 Markdown 或结构化 JSON 自动处理 JS 渲染、反爬绕过、多页爬取 支持自托管或 API 调用 学习笔记: 这个工具的出现其实反映了一个大趋势——以前爬虫的目标是「把数据抓下来」,现在 AI 时...
SoybeanAdmin 简介:一款清新优雅的全功能后台管理模板
项目概述 SoybeanAdmin 是一个清新优雅、高颜值且功能强大的后台管理模板,由 SoybeanJS 团队开发和维护。项目基于当前最流行的前端技术栈构建,包括 Vue3、Vite、TypeScript、Pinia 和 UnoCSS。它内置了丰富的主题配置和组件,代码规范严谨,实现了自动化的文件路由系统。SoybeanAdmin 为开发者提供了一站式后台管理解决方案,开箱即用,同时也是学习前沿技术的优秀实践项目。 目前项目在 GitHub 已获得 26k+ Star,拥有活跃的开源社区和完整的周边生态体系。 技术栈与架构 核心技术 SoybeanAdmin 采用了当前社区最热门的前端技术栈: Vue 3.4+:使用最新的 Vue3 语法特性,支持 Composition API 和 <script setup> 写法 Vite 8:下一代前端构建工具,提供毫秒级热更新和极速的开发体验 TypeScript:支持严格的类型检查,大幅提升代码可维护性和开发体验 Pinia:新一代 Vue 状态管理库,简洁且支持完整的 TypeScript 类型推导 ...
轻量级自托管私有云平台FolderHost
什么是 FolderHost ? FolderHost 是一个轻量级的自托管私有云平台。它可以帮助用户在单个可执行文件中搭建完整的文件管理和协作系统,无需复杂的依赖和配置。具备许多功能,如文件管理、用户管理、实时协作、恢复箱、日志等。但目前它还不是为移动设备设计的。 主要特点 单二进制部署:无需安装 PHP、数据库等依赖,一个可执行文件即可运行,Windows/Linux 仅约 19MB 实时协作编辑:内置 Monaco Editor,支持多人实时协作编辑代码文件- 多用户权限管理:完整的用户权限系统,支持细粒度的权限控制(读取、上传、删除、下载等)- 文件管理功能:支持文件上传、下载、移动、复制、重命名等完整操作,支持大文件分块上传- 回收站功能:删除的文件进入回收站,可配置存储上限,避免误删导致数据丢失- 审计日志:记录所有用户活动,支持自动清理日志- JWT 安全认证:基于 JWT 的安全认证机制,Token 有效期 24 小时,绑定登录 IP 和 User-Agent- 开源免费:基于 GPL-3.0 协议开源,可免费使用和修改 应用场景 个人文件存储...
Platform Admin Prototype - 平台管理原型系统
简介 Platform Admin Prototype 是一个基于现代 Web 技术栈构建的后台管理系统原型。它提供了企业级应用所需的核心基础设施,包括用户认证、权限管理、数据展示、表单处理等通用功能,帮助开发团队在几天而非几周内搭建起生产可用的管理后台。 设计理念 约定优于配置 - 开箱即用的最佳实践,减少决策疲劳 渐进式增强 - 核心功能稳定,扩展功能按需引入 类型安全优先 - 全栈 TypeScript,编译期捕获错误 开发体验至上 - 热重载、自动生成、一键部署 适用场景 场景 推荐度 说明 内部管理后台 (CMS, ERP, CRM) ⭐⭐⭐⭐⭐ 标准 CRUD + 权限控制 SaaS 多租户管理平台 ⭐⭐⭐⭐ 内置租户隔离架构 数据大屏/可视化看板 ⭐⭐⭐ 需配合图表库扩展 高并发实时系统 ⭐⭐ 建议引入 WebSocket/微服务 核心功能 1. 用户认证与授权 12345678910┌─────────────────────────────────────────────────┐│ 认证体系 ...
Ansible 难学、Jenkins 太重?试试这款开箱即用国产自动化运维平台
在很多中小型团队或初创公司中,运维工作往往停留在“半刀耕火种”阶段: 批量操作全靠肉身:改一个配置要挨个机器敲 SSH,几十台机器改到眼花 代码发布全靠手搓:拉代码、打包、杀进程、起服务全靠手动执行或者维护极其脆弱的 Shell 脚本 权限与执行记录混乱:谁在机器上执行了什么命令无法追溯,缺乏标准化的审批流 Ansible 学习曲线陡峭:想要落地自动化,但 YAML 语法与庞大概念让团队新人望而却步。 如果你的团队需要一套轻量级、开箱即用、完全可视化的自动化运维与持续部署系统,那么这款在 GitHub 狂揽 35k+ Star 的国产开源利器——Spug,绝对能让你相见恨晚。 什么是 Spug? Spug 是一款专为中小型企业和团队打造的开源轻量级自动化运维与持续交付平台。 它采用免 Agent(Agentless)架构,只要目标主机支持 SSH 协议即可完成纳管,集成了主机管理、批量执行、自动化发布、定时任务、监控告警等运维核心场景,致力于帮助开发者与运维以极低门槛告别重复繁琐的人工作业。 为什么推荐它?五大核心功能 1. 免 Agent 主机纳管与 Web 终端 基于 ...
做前端别再到处找 Icon:8 个高质量图标网站
做前端,做按钮只要几分钟,找一枚风格合适、能商用、还能直接接进项目的 Icon,却常要打开十几个网站来回翻。数量多不等于风格统一,能下载 SVG 也不代表 Logo 可以随意改。选错一次,后面改样式、换字体、适配组件都是额外成本。 我按 2026 年 8 月的官方页面,从数量、一致性、SVG、组件、许可、搜索和配色七个维度筛出 8 个站,按实际开发场景分成通用、品牌和动态三类,方便你直接对号入座。 通用图标 1. Iconify:搜遍多个图标集 聚合 30 万+图标、200+开源图标集,可复制 SVG,也有现成的 React、Vue、Svelte、Tailwind 接入方式,前端接入非常省事。Api 覆盖最广,但各集合风格和许可不同,项目里最好固定一两个来源,避免风格打架。 更多说明请访问官网 2. Lucide:线性图标首选 约 1760 枚图标,线宽、圆角和网格统一,支持 SVG 及主流前端组件,可调颜色、尺寸和描边。ISC 许可很宽松,适合后台管理和极简产品,直接组件化使用很舒服。 更多说明请访问官网 3. Tabler Icons:数量与生态均衡(适合设计系统) 约 61...
MediaCrawler 一行命令批量爬取小红书、抖音、B站公开数据
做竞品分析、舆情监控、用户研究,最头疼的就是手动复制粘贴数据,一条条从平台搬运既费时间又容易出错。自己写爬虫?每个平台结构不一样,反爬机制各不相同,光是绕过加密签名就劝退一大半人。今天分享一款 GitHub 上 Star 数极高的开源多平台自媒体数据采集工具 MediaCrawler,一行命令批量抓取小红书、抖音、快手、B站、微博、贴吧、知乎七大平台的公开数据,无需懂 JS 逆向,本地部署即可使用。 一、项目基础档案 项目名称:MediaCrawler 开源地址:https://github.com/NanmiCoder/MediaCrawler 开源协议:MIT(可修改、可私有化,保留版权声明即可) 作者:NanmiCoder(独立开发者) 开发语言 & 技术栈:Python + Playwright + Node.js 支持平台:小红书、抖音、快手、B站、微博、贴吧、知乎七大平台 数据输出:CSV / JSON / JSONL / Excel / SQLite / MySQL 核心适用人群:数据分析师、竞品监控团队、学术研究者、爬虫学习...








