即刻App年轻人的同好社区
下载
App内打开

前端开发者小站

</div><script>alert('hello')</script><div>

9226人已经加入

  • 驴嫂
    5天前
    哪怕就在两个月前,做这样的带动效的 svg bento grid都会要了老命。别管调教用任何 skill 怎么写 prompt 怎么喂参考案例,做出来的东西都很 der。

    现在 GPT 6.1 Sol 大白话,一版过。Opus 5.5 岂不是直接起飞。
    00:11
    00
  • 桑稚oni
    19天前
    第 36 个:ebertti/awesome-telegram —— “电报全宇宙的官方级百科全书”
    属性:资源精选合集(Awesome 系列)
    通俗比喻:在开源界,只要带“Awesome”的项目,就是该领域的“国家地理级百科全书”。
    它是干啥的:这个作者花了数年时间,把全球开发者用各种语言(Python、Go、Java、Rust等)给 Telegram 写的最好用的工具、最酷的机器人、最火的频道,分门别类整理成了一个长长的“光荣榜”。任何人想在电报里开发东西,先来这里翻一翻,就能找到全球最顶尖的现成轮子,省去 90% 的重复造轮子时间。

    第 37 个:itgoyo/TelegramGroup —— “老司机与网络侦探的中文大黄页”
    属性:中文频道/群组导航站(10000+ 社群索引)
    通俗比喻:相当于电报中文世界的“114 查号台”加“hao123 导航”。
    内幕与门道:
    刚玩 Telegram 的中文用户,最常问的一句话就是:“群在哪?怎么找好玩的频道?”
    这个项目直接收录了超过 10,000 个中文群和频道,涵盖技术、外贸、吃瓜、影视、加密货币等。
    在引流与黑产眼里:这是绝佳的“靶场地图”。很多做批量引流、做精准客户挖掘的人,直接拿着这个列表写脚本,顺藤摸瓜去各个群里抓成员数据(OSINT 情报搜集)。

    第 38 个:overtake/Telegram-Swift —— “苹果电脑(Mac)上的性能猛兽”
    属性:用 Swift 纯原生写的 macOS 客户端
    通俗比喻:这是 Telegram 官方专门给苹果 Mac 电脑打造的“专属西装”。
    门道:很多跨平台软件在 Mac 上又卡又费电(比如用网页套壳做的软件)。但这个项目完全是用苹果亲生的 Swift 语言一行行敲出来的,动画丝滑到极致,对苹果 M1/M2/M3/M4 芯片做了极致优化。它证明了 Telegram 团队在客户端打磨上的病态级技术追求。

    第 39 个:telemt/telemt —— “用高精尖‘钛合金’打造的防封加速器”
    属性:Rust + Tokio 编写的高并发 MTProto 代理
    通俗比喻:上一轮讲的那个代理是用 Python 写的,好比一辆家用小轿车;而这个是用 Rust 语言写的,相当于一辆“装甲防弹、跑得飞快的钛合金重型高铁”!
    为什么这么猛:
    Rust 语言的特性:极度安全、速度快如闪电、哪怕几万人同时在线挤带宽,服务器也不会内存泄露或崩溃。
    防封锁(Anti-Censorship):它能把 Telegram 的通信数据伪装成完全正常的 HTTPS 网页浏览,专门用来对付最严密的企业防火墙或国家级防火墙,又稳又快。

    第 40 个:tangyoha/telegram_media_downloader —— “自带网页后台的资源抽水泵”
    属性:带 Web 界面与 Bot 控制的媒体下载器
    通俗比喻:之前讲的 tdl 是给黑客用的黑框框(命令行),而这个是给普通人准备的“傻瓜式豪华下载器”。
    它有多爽:
    它配有一个漂亮的网页控制台(Web UI),像迅雷一样,清清楚楚显示每个视频下载了百分之几、速度多少。
    远程操控:你人还在外面上班,在手机上给自己的私人电报机器人发一个频道链接,家里电脑上的这个程序就会默默把该频道里所有的几个 G 的大片全自动下载到你的移动硬盘里,等你回家就能直接看。

    第 41 个:tather-bot/chatgpt_telegram_bot —— “住在电报里的私人 AI 秘书”
    属性:基于 OpenAI / Claude 的 Telegram 机器人
    通俗比喻:把世界上最聪明的脑袋(ChatGPT 和 Claude),直接塞进了你的电报聊天窗口里。
    玩法与效益:
    不用每个月花 20 美元去网页端排队登录,你在电报里给它发文字、发语音,它秒回你。
    支持群聊协同:把它拉进你们的团队工作群,只要有人 @它,它就能充当金牌客服、翻译官、代码纠错员。很多海外电报社群用它来实现 24 小时全自动多语言智能回复,一个人就能管几千人的大群。

    第 42 个:Neet-Nestor/Telegram-Media-Downloader —— “专治‘防白嫖限制’的破壁锁匠”
    属性:油猴脚本(Tampermonkey Script),网页版强制下载
    通俗比喻:这是一把专门撬开频道主“防盗门”的万能钥匙!
    它是怎么砸场子的:
    很多付费资源频道、私密群组,为了防止别人倒卖,在后台开启了“禁止保存、禁止截图、禁止转发”。你在手机端想点保存,系统直接提示“群主限制保存媒体”。
    这个脚本运行在你的电脑浏览器里(网页版电报)。它不管群主怎么限制,直接在网页最底层的代码缓存里抓取视频和原图,在每个受限的视频旁边硬生生强行加一个“【下载】”大按钮!只要你眼睛能在屏幕上看到的,点击一下就能强制扒下来,防盗措施彻底作废。

    第 43 个:rubenlagus/TelegramBots —— “企业级大厂的‘钢铁生产线’”
    属性:Java 版官方生态最强的 Bot 开发库(深度整合 Spring 框架)
    通俗比喻:前面讲的 Python 和 Node.js 是轻骑兵,而这个是银行、跨国大企业才会动用的“重工业母机”。
    应用场景:
    全球那些正规大型企业(比如跨国银行的账户通知系统、大型电商的物流推送系统),底层几乎全是用 Java 搭建的。
    如果大企业想把自己的内部业务和 Telegram 打通,这个库就是首选。它极其稳定,能抗住数以亿计的并发消息,哪怕几万人同时找机器人办业务也稳如泰山。

    第 44 个:UnigramDev/Unigram —— “微软 Windows 系统的天花板亲儿子客户端”
    属性:基于 WinUI 开发的第三方 Windows 客户端
    通俗比喻:这是专门在微软电脑(PC)上运行的“颜值与功能并存的究极定制版电报”。
    杀手级功能:
    它是严格按照微软 Windows 系统的原生视觉风格(Fluent 设计语言)做的,界面比官方版还要现代、还要顺眼。
    完美支持秘密聊天(Secret Chat):很多人不知道,官方的电脑版 Telegram 是不支持端到端加密的“秘密聊天”的(官方只能在手机上开)。而这个 Unigram 逆向攻克了技术难关,破天荒地在电脑大屏幕上实现了阅后即焚、端到端加密的秘密聊天!深受隐私极客和需要电脑私密办公人群的狂热追捧。

    第 45 个:TG 账号变无限云盘(以 caamer2/tg-storage 等项目为代表) —— “把 Telegram 当做免费白嫖的‘无限容量百度网盘’”
    属性:利用 Telegram 无限存储特性的分布式网盘工具
    通俗比喻:这是全球白嫖怪和极客们发现的“全网最大 Bug 级免费矿藏”!
    它的原理到底有多绝?
    Telegram 官方有一个极其良心(甚至可以说是做慈善)的规则:允许任何用户免费、无限制地上传 2GB 以内的单个大文件,并且永久保存、终身不限速、不限总容量!
    这个开源项目,就是用代码把你的 Telegram 账号变成了一个全功能的私人云盘(甚至支持挂载到电脑当本地硬盘用)!
    运作机制:

    1. 你在网页前端上传一部 4K 电影或几个 G 的压缩包;
    2. 后台程序会自动把文件切成一小块一小块;
    3. 程序自动调用 Telegram 接口,把这些碎片文件全部分批偷偷发送到你的电报“收藏夹(Saved Messages)”或私密频道里;
    4. 当你需要下载时,程序再从电报服务器把这些碎片拉回来,在本地秒拼成完整文件!
    结果:你一分钱不花,不需要冲百度网盘或阿里云盘会员,直接白嫖了 Telegram 官方在全世界顶尖数据中心里的无限 TB、终身免费、高速下载的云端存储空间!

    这十个工具拼出的真实图景:

    现在看全这 10 个项目,你就会发现 Telegram 早已超越了“聊天软件”的范畴:
    下资源/盗资源:有 #40 的网页抽水泵 和 #42 的破壁脚本,任何付费墙在它们面前都是纸糊的;
    白嫖硬件:有 #45 的网盘工具,把全球富豪杜罗夫的服务器当成自己的免费硬盘;
    搞私密/跨平台极致体验:Mac 上有 #38,Windows 上有支持电脑端秘密聊天的 #44;
    智能与安全:有 #39 的 Rust 抗封神器 和 #41 的 24 小时 AI 自动军团。

    这套体系,展示了一个庞大而自由的全球技术地下世界
    00
  • 大乐乐_E5ql
    20天前
    【BuildInPublic】我用 AI 从零做个小程序,第一关就卡住 4 件事 😅
    做了个小工具叫「到账记」:给开了微信虚拟支付的个人开发者算账用的——记一笔收入,自动算限额比例、手续费、到手金额。
    本以为写完代码就完事,结果上线第一关是四件套:
    ✅ 小程序基础信息(名称/头像/服务内容,备注写啥都有讲究)
    ✅ 服务类目(多勾一个都可能被驳回,说多了都是泪)
    🔄 备案(服务内容差点全勾上,"四要素关联性"了解一下)
    🔄 微信认证(30 元/年,发票抬头=本人名字、税号=身份证号,学到了)
    现在备案和认证都在审核中,后面还有 12381 短信核验、管局审核、开通虚拟支付……
    我会把每一步都记下来发出来——这些坑每个个人开发者迟早都要踩一遍。
    关注我,看一个小程序从"卡在备案"到"赚到第一笔 19.9"的全过程。
    10
  • Iris21点后消息隔天回
    22天前
    小红书的反爬机制也太厉害了
    已经放到很慢的速度了
    但是基本爬一轮就gg了
    第二轮就会被警告或者直接禁止了
    10
  • 桑稚oni
    25天前
    如果说纯正的Linux系统是一间伸手不见五指、地上布满陷阱、四周全是暗器口诀的阎王殿,那么宝塔面板里的那个文件管理,就是有人在这座阴森森的阎王殿上头,硬生生凿开了一面透亮的大玻璃天窗,在屋里点上了几十盏明瓦灯,给原本冰冷凶险的机关全贴上了大白话的标牌和抽屉把手。

    在过去,平头百姓想在服务器里挪个文件、改行代码,得哆哆嗦嗦在黑漆漆的命令行里敲cd、ls、chmod、tar -zxvf,少敲一个空格或者错打一个斜杠,整座宅院瞬间化为飞灰。

    而宝塔的文件管理,就是把这一切粗暴的符咒,变回了你最熟悉的、在自家电脑上指哪打哪、拖拽复制、鼠标右键的温顺模样。

    今天就把烟袋锅子点上,带你一五一十、从头到尾摸一摸宝塔文件管理这座数字大账房的机关门道,教你怎么把它玩得滴水不漏。

    第一回:登堂入室 —— 宝塔文件管理的核心十八般武艺

    点开宝塔左侧菜单栏那个黄灿灿的文件图标,跳出来的界面就像你在Windows里的我的电脑。但可别小看了它,这后头暗藏着七路绝学。

    1 隔空投送:大肚能容的上传与拖拽

    怎么玩:

    你在本地电脑上写好了自动化Python脚本、做好了网页、或者打好了压缩包,根本不需要什么FileZilla、WinSCP之类的老旧FTP工具。

    直接用鼠标按住本地文件,往宝塔文件管理的网页窗口里一拖、一松手,底下的进度条就飞速跑起来了。

    长处:

    它支持大文件分片上传。几百兆甚至上1个G的大压缩包丢进去,哪怕中间网络打了个盹,它也能接着断点继续传,不会动不动就前功尽弃让你从头再来。

    2 就地开箱:拯救性命的在线打包与解压

    送你一句在服务器里讨生活的至理名言:宁传1个1GB的压缩包,绝不传1万个10KB的碎文件。

    血泪真相:

    初学者最容易干的蠢事,就是把一个包含几万个零碎文件的代码库,直接往服务器里拖。网络要给每个文件挨个核验、排队握手,本来1分钟能解决的事,能活生生传上3个时辰,中间断1次线就全盘皆输。

    宝塔的神通:

    在本地把文件夹打成1个.zip或.tar.gz压缩包上传;传到宝塔文件管理器后,鼠标右键点击压缩包,选择解压,只听得服务器机房里一阵轻响,3秒钟之内,几十万行代码和素材在远端瞬间铺开。

    反过来也一样,想把服务器里的资料带回家,右键一勾选,点击压缩,它就在远端几秒钟压成1个包,直接单链下载,干净利落。

    3 当堂改写:免去来回折腾的在线编辑室

    怎么玩:

    很多时候,代码部署上线后,只需要改1个配置参数、换1个数据库密码、或者改1个端口号。

    过去的做法是:下载到本地,本地用记事本改,保存,重新上传覆盖。麻烦得让人撞墙。

    宝塔的神通:

    在宝塔里,遇到.py、.php、.html、.json、.conf这些文本文件,双击它,或者右键选择编辑,屏幕上立刻弹出1个极专业的黑色代码编辑器(内置的是业内顶尖的Monaco或Ace编辑器内核)。

    它自带代码高亮、行号显示、自动缩进、快捷键查找替换(Ctrl+F)。改完按一下Ctrl+S(保存),修改立刻在千里之外生效。

    4 画地定尊卑:降伏恶鬼的可视化权限与所有者(最核心)

    这是九成新手在Linux里碰得头破血流的地方——明明文件在里面,为什么系统死活说没有权限、或者网页打不开报500?

    宝塔怎么破局:

    在宝塔文件列表里,每1个文件后头,都清清楚楚标着两样东西:权限(如755、644)和所有者(所有者或用户组,如www:www或root:root)。

    你只要右键点击文件,选权限,它不会逼你背那些晦涩的数字算式,直接给你弹出1张九宫格勾选框:

    所有者能干嘛?(读、写、执行)

    用户组能干嘛?

    公共路人能干嘛?

    勾选完了,下面还会贴心地带1个应用到子目录,一键扫平千家万户。

    5 乾坤大挪移:用机房光纤狂飙的远程下载

    怎么玩:

    你想往服务器里放1个存放在GitHub、或者某个公开网盘、某个软件官网的安装包(动辄几个G)。

    普通人干傻事:自己在家里电脑点下载(耗时半小时),再从家里电脑上传到宝塔(又耗时半小时)。

    宝塔的神通:

    点击顶部的远程下载按钮,把那个文件的网络直链(URL)往输入框里一贴,点确认。

    云服务器直接调动机房里上百兆、甚至千兆的专用骨干网络,自己跑到那个网址去把东西生生拽过来。你揉揉眼睛的工夫,几十个G的大物件已经稳稳当当躺在你的目录里了。

    6 保命后悔药:悬崖勒马的回收站机制

    在原生Linux里,有1道闻风丧胆的灭门符咒叫rm -rf /,一敲下去,祖坟都能被刨平,神仙也救不回来。

    宝塔在文件管理顶部,常年挂着1个回收站开关。

    只要这个开关开着,你在界面上随手误删的文件,不会真正灰飞烟灭,而是被偷偷移步进了1个叫暗室的临时箱子里。

    哪天发现手滑删错了核心数据,点开回收站,找到那个文件,点一下恢复,当场原路奉还,死里逃生。

    7 大理寺搜山:上天入地的文件与全文检索

    搜文件名:在右上角搜索框打字,支持用通配符.log、2026*模糊查找。

    搜文件内容(全文搜索):这才是压箱底的绝活。有时候你知道自己某段代码里写了个配置叫SECRET_KEY_12345,但你忘了它藏在几十个文件夹里的哪1个文件里了。

    在宝塔搜索里选文件内容,敲下这段文本,它就像探针入海,帮你穿透所有文本文件,把藏着这句话的文件连同第几行都给你挑出来。

    第二回:胸中有沟壑 —— 宝塔这宅子里的四大门牌号

    进了宝塔文件管理,不能像无头苍蝇一样乱撞。Linux的目录多如牛毛,但对做业务、搞自动化的掌柜来说,你这辈子只需要死死盯住以下4个门牌号。

    /(根目录,天下一统的起点)

    ├── www/ 核心重地:掌柜的所有家当全在这

    │ ├── wwwroot/ 1 前厅商铺:你的网站、API接口、自动化脚本大本营

    │ │ ├── my_website/ 比如你家商铺的根目录

    │ │ └── my_python_bot/ 比如你的自动化长工驻扎区

    │ ├── server/ 2 后厨机房:宝塔装的软件引擎(Python、Nginx、MySQL)

    │ │ └── panel/ 特别禁区:这是宝塔管家自己的卧房,千万别手欠去删改

    │ └── backup/ 3 后院地窖:宝塔自动给你存的数据库和网站备份压缩包

    ├── var/log/ 4 衙门案卷:系统和软件运行留下的运行日志,查案看它

    └── root/或home/ 散兵游勇的私宅,平时不用管

    给你画个红圈:你平时的所有折腾,99%都应当老老实实圈在/www/wwwroot/这个抽屉里。

    这个地方就是官府划给你的特区,在这里你怎么折腾、怎么写代码、怎么建文件夹都不容易伤及系统元神;要是跑到/etc或者/bin那些官署重地里乱搬砖头,一不留神国家大门就被你拆了。

    第三回:我的滴血避坑四戒律

    见识过无数后生,宝塔文件管理用得风生水起,最后却哭爹喊娘来求救。就是因为没把下面这4根暗桩放在心上。

    戒律一:防鸠占鹊巢 —— 警惕属主权限混乱

    这是新手犯病率最高的顽疾。

    现象:宝塔环境里的网站或服务,通常是由1个叫www的虚拟长工在后台挑大梁跑着的。

    惨剧:你用宝塔自带的文件管理器或者终端(此时你的身份是高高在上的root皇帝),手动上传或新建了1个文件。这个文件的户口本(所有者)默认就落成了root:root。

    恶果:当外面的客人通过网页访问时,当差的长工www想要去读写这个文件,系统一看门牌:大胆!这是root皇帝的私物,你个叫www的奴才也配碰?当场摔杯报403 Forbidden或500 Server Error。

    化解心法:凡是放到/www/wwwroot/目录给程序用的文件,存好后顺手看一眼属主。如果不是www,右键点击它,权限修改里把所有者改成www,用户组改成www。

    戒律二:防盲人骑瞎马 —— 改文件前必须就地生子

    在宝塔在线编辑器里改配置文件(比如nginx.conf、或者主运行脚本app.py)时,人总有自信膨胀的时候,觉得我就改两个字母,绝对没错。

    结果一保存,服务当场起不来了,自己又忘了刚才删了哪一行。

    化解心法:动手改任何重要配置文件前,养成骨髓里的肌肉记忆:鼠标右键点击原文件,点击复制,紧接着点击粘贴。

    系统会在旁边生出1个叫app.py.bak或者app_副本.py的小崽子。留了这道护身符,你再去正房里大刀阔斧地改。改崩了?1秒删掉,把副本名字改回来,起死回生。

    戒律三:防暗度陈仓 —— 别让回收站吃撑了你的肚皮

    宝塔的回收站是个大慈大悲的好东西,但它有个坏毛病:它装进去的东西,依然老老实实占着你的真实硬盘空间。

    有些掌柜天天在服务器里跑大数据、解压几个G的日志,用完就点删除。以为删干净了,过了两个月,系统突然报警说硬盘爆满,数据库死锁停机了。

    一查账,发现文件全在,都在回收站这个地窖里堆得发霉发臭。

    化解心法:每隔1个月,顺道点开文件管理器右上角的回收站,看一眼里面的破铜烂铁,确认真用不上了,点一下清空回收站,把被占用的硬盘地契彻底赎回来。

    戒律四:防开门揖盗 —— 绝不可给整个目录无脑上777

    很多人一遇到文件写入失败、没有权限,就在网上瞎搜,某些三脚猫半吊子就教他:在宝塔里把目录权限改成777就行了。

    这是饮鸩止渴。777意味着天下所有的阿猫阿狗、任何1个黑客只要顺着漏洞摸进来,都能当场改写甚至执行这个目录下的任何文件。

    化解心法:

    普通的网页和代码文件:给644(主家能改,别人只能看)。

    普通的文件夹:给755(主家能进能改,别人能进能看不能改)。

    只有个别确实需要由程序上传图片的文件夹(比如uploads),才酌情在www属主下放开必要的写入权限,但绝不能把执行权(x)滥发给外人。

    摸清了宝塔文件管理的门道,你在云端的那台无头电脑,就再也不是冷冰冰、拒人于千里之外的铁疙瘩了。

    它就像你自家庭院里摆设得规规矩矩的百宝阁——哪个抽屉放衣裳,哪个匣子收银票,哪把锁该挂在大门上,全在你鼠标的一点一滑之间。

    有了这双透视眼,以后管他是部署前面说的八套自动化长工,还是开门支摊做网页买卖,你坐镇在这一方水灵灵的网页中军帐里,运筹帷幄,万物皆在股掌之中,何等惬意,何等踏实。
    00
  • 桑稚oni
    1月前
    很多没接触过现代编程的人最容易产生误解的地方

    很多人以为的“用 AI 挂机跑一晚上”是:对着 ChatGPT 说一句话:“帮我把那个网站克隆下来”,然后电脑就自动开始动了——这在现实中是不存在的。因为网页端的大模型无法直接操控你的电脑桌面,它只能输出文字和代码。

    真实发生的情况是:这个初学者在睡前的 1~2 个小时里,通过“多轮对话(Prompt Chaining)”,把 GPT 当作一个 24 小时随叫随到的高级程序员,一段一段地向它索要代码、把报错日志丢给它修改,最终把几个功能模块拼成一个完整的 .py 脚本,在本地终端里敲下运行回车,然后去睡觉。

    为了让你彻底看清他是怎么做到的,下面我把他在睡前跟 GPT 对话的完整提示词(Prompt)过程、对话轮次、真实发生的调试细节,以及脚本挂机一整晚的底层运行逻辑,全景式地复原给你

    第一阶段:他在睡前到底跟 GPT 说了什么?(核心对话全景复原)

    整个过程不是一句话,而是分为极其典型的 5 到 6 轮精准提问。他用自然语言下达指令,GPT 则输出标准代码:

    第一轮:分析目标网站结构(提取规则生成)

    初学者对 GPT 说:
    “我现在想抓取一个网站的文章。这是我用浏览器‘审查元素’复制下来的一篇详情页 HTML 代码片段:[此处粘贴了一大段包含标题、发布时间、正文和百度网盘下载框的 HTML 源码]。
    请帮我用 Python 的 BeautifulSoup 或 CSS 选择器,写几行提取逻辑:分别把文章标题、正文文本、VIP 专享的网盘链接和提取码精准提取出来,存成一个字典。”

    · GPT 的响应:分析了 HTML 的类名(Class Name)和标签结构,直接给出了 soup.select_one('.entry-title').text、soup.select('.download-box a') 等精准的提取代码。

    第二轮:构建自动化抓取框架(解决登录与翻页)

    初学者对 GPT 说:
    “目标网站有分页,列表页是从 xxx.com 到 page/100。而且下载链接必须登录才能看。我已经在这个网站买了一个账号,在浏览器里拿到了 Cookie 字符串:[粘贴 Cookie]。
    请用 Python 的 Playwright 异步库给我写一个完整的爬虫框架:

    1. 自动带着我的 Cookie 访问每一页列表;
    2. 从列表页提取所有文章的详情页 URL;
    3. 自动遍历每一个详情页,用你刚才写的提取逻辑拿到数据;
    4. 每抓完一篇,先保存到本地的 data.json 文件里,防止中间中断。”

    · GPT 的响应:生成了一个标准的 Python 异步爬虫脚手架,包含了 browser_context.add_cookies() 和递归遍历 URL 列表的 async for 循环结构。

    第三轮:在脚本中嵌入“GPT 自动洗稿与脱敏”中继(核心智能化)

    这一步是整个项目最具杀伤力的地方。初学者让 GPT 在写爬虫脚本的同时,把调用大模型 API 的代码也写了进去。

    初学者对 GPT 说:
    “我现在有 OpenAI 的 API Key。我想在抓取到每一篇文章后,不直接保存,而是先调用大模型的接口对文章做一次处理,处理规则如下:

    1. 把标题重新改写,风格要吸引人,适合做 SEO 搜索;
    2. 把正文里所有出现的原作者名字、微信号、QQ群号、公众号全部删干净;
    3. 把正文中的‘XX网创’替换成‘老张副业社’;
    4. 把提取到的百度网盘链接保留,格式化输出为 JSON。
    请帮我写一个 clean_content_with_gpt() 函数,无缝嵌入到刚才的爬虫流程中。”

    · GPT 的响应:编写了调用 OpenAI API 的请求封装函数,将每篇爬下来的文章作为 Prompt 变量,让大模型在后台进行毫秒级的清洗与改写。

    第四轮:报错排查与防崩溃机制(初学者的“救命稻草”)

    初学者把前面几段代码拼在一起运行,终端立刻弹出红字报错(如网络超时、连接重置、某个页面缺少标签导致 NoneType error)。

    初学者对 GPT 说:
    “我运行脚本的时候报错了,终端显示:AttributeError: 'NoneType' object has no attribute 'text' at line 45,还有几篇报了 TimeoutError: Page crashed。
    我怎么改才能让它遇到报错不中断退出?请帮我加上 try-except 异常捕获、自动重试 3 次机制,并且每次抓取之间加上 1 到 3 秒的随机等待,防止被对方封 IP。”

    · GPT 的响应:将整个爬虫进行了工业级健壮性封装,加入了 tenacity 重试库、随机 asyncio.sleep(),以及将抓取失败的链接自动记录到 failed_urls.txt 的容错机制。

    第五轮:自动化入库与发布(组装最终的 main.py)

    初学者对 GPT 说:
    “最后一步,我自己在宝塔面板搭了一个新的 WordPress 网站,开启了 REST API 功能。这是我的后台发布接口地址和 Application Password。
    请写一个发布函数,把洗好的文章标题、正文、分类目录、自定义字段(网盘下载地址和密码),全自动通过 POST 请求发布到我的 WordPress 网站上。
    最后,把以上所有代码整合进一个单一的 main.py 文件,我只需要在终端运行 python main.py 就能全自动跑。”

    · GPT 的响应:输出了一套长达数百行的完整单文件自动化脚本。

    第二阶段:他敲下回车后,这一晚上电脑里到底在发生什么?

    初学者拿到最终的 main.py 后,在自己的电脑或租来的云服务器终端里敲下了运行命令:


    1. 无头浏览器在内存中静默穿梭:屏幕上没有任何画面,但内存里的 Chromium 正在一页一页地打开目标网站的列表,点击、翻页、解析 DOM 树,把文章正文、配图地址、百度网盘与夸克网盘链接一网打尽。
    2. 多线程并发调用大模型:脚本抓取到数据后,通过 API 批量丢给大模型。大模型在云端充当流水线工人,每秒钟都在把抓来的文章剥离原作者信息、改写标题、生成摘要。
    3. 数据源源不断注入新站:清洗好的数据通过 HTTP 请求直接打入新网站的数据库中。
    4. 日志忠实记录:遇到个别死链或反爬拦截,脚本自动记录错误日志并跳过,绝不卡死。

    第三阶段:为什么初学者能做到这一切?

    在过去,完成这一整套操作需要:

    · 扎实的 Python 编程能力;
    · 熟练掌握前端 DOM 结构分析与抓包调试;
    · 深刻理解 HTTP 协议与 RESTful API;
    · 具备编写高并发、容错机制的架构思维。

    但通过大模型的自然语言交互,技术实现的门槛被从“手写代码”降维成了“逻辑表达”:

    · 这个初学者不需要知道每一行代码的具体语法,他只需要知道“整个业务流程应该分几步走”;
    · 他只需要具备将大任务拆解为小指令的能力(先抓列表 → 再抓详情 → 送入清洗 → 写入数据库);
    · 遇到任何报错,他只需要充当一个“日志搬运工”,把错误信息复制回给大模型,大模型就会给出修补补丁。

    这就是这位初学者能靠着自然语言对话,在极短时间内拼装出一套高杀伤力的自动化采集与洗稿系统,并挂机运行一整晚的完整技术真相
    25
  • Zzz横
    1月前
    这纯前端你信么
    00
  • AIexplorerL
    1月前
    看着gpt 6发布,前端审美说加强以及跑分,我有点又想续订了
    20
  • Ginlon
    1月前
    意料之外的软广 没绷住🤣
    00
  • 理想是自由
    1月前
    没吃过💩的兄弟可以尝试一下小程序开发
    21