

就在刚刚,OpenAI又进化了!备受瞩目的ChatGPT Sites正式开启公测——哪怕你一行代码都不会写,只需几句自然语言,或者上传一张草图,就能像写Google文档一样,在十几分钟内生成一个高度专业、功能复杂的交互式网站!只靠说话就能完成前端开发,传统的建站SaaS行业,正被彻底颠覆。
曾几何时,拥有一流的个人网站,是程序员和专业设计师的特权。后来出现了Dreamweaver,再后来有了Wix、Squarespace等拖拽式建站工具。但今天,ChatGPT Sites直接把门槛踏碎了。知名科技媒体实测后给出极高评价:
「现在,制作一个美观的网站,就像创建一个Google Doc一样简单。」
目前,该功能已向Plus、Pro、Business等全量用户开放。
注意,这不再是简单的「套模板」,而是真正的Vibe Coding!
有人用它做出了一站式在线商店,支持将商品直接拖进购物篮;还有人做出了一个艺术绘画工具GoalFlow——选择国旗后,用国旗颜色在流体模拟画布上「作画」,颜料像水中色素般自然旋转。这种涉及复杂物理引擎的页面,过去要高级工程师花数周,如今几句提示词就搞定!你甚至能几句话做出Jenga风格的物理游戏《Glass Towers》,或街机小游戏《Paper Glider》。
ChatGPT给出初稿后,你可以在侧边栏用「注释工具」,像批改作业一样在网页上画圈:「按钮颜色改掉」「字体换成无衬线体」「替换这张图片」。它不仅能听懂,还能无缝修改!
虽然早期的Lovable、Bolt等AI建站工具仍有灵活性,但ChatGPT Sites的王炸在于:它根植于庞大的ChatGPT生态。在「Project」中工作,它会自动读取你的品牌风格指南、Logo库,生成的网站天然带着你的品牌DNA。
前端工程师,被降维成了「提示词产品经理」。那些靠「拖拽建站」收高昂月费的传统SaaS,若不转型,恐怕熬不过今年冬天了!
回看人机交互史:从命令行(CLI)、到图形界面(GUI)、再到自然语言界面(LUI),本质就是一部不断降低操作门槛的历史。ChatGPT Sites,把前端开发从「工程学」降维成了「表达学」。
过去,你要建网站,大脑得经过多层翻译:我要卖东西 → 需要购物车和支付系统 → 写HTML/CSS/JS → 对接数据库。现在,这些中间环节全部消失,输入直接被降维成纯粹的自然语言——最原始的「意图」。传统SaaS的壁垒是「把代码封装成好看的按钮」,而大模型的降维打击是:你只要张嘴说话就行!
与此同时,AI研究员公布的一组测试,震撼了无数工程师。测试极其简单:把声音变成一张图,让GPT-6直接读图。
研究员给GPT-6上传了一张Mel频谱图(将声音的频率、时间、能量可视化的影像),全程未播放任何音频,模型也完全断网。唯一的提示词是:「这个声音来自一种动物/哺乳动物。」GPT-6回答:「鲸鱼,可能是一头蓝鲸。」
全网震惊了!因为背后的推理逻辑,已远超简单的图像匹配。蓝鲸发出极低频叫声,但狮子、老虎、大象同样落在40-200赫兹低频区间。仅凭频谱图上一坨能量,根本无法断定是鲸鱼!音频工程师分析认为:GPT-6敏锐捕捉到了「能量随时间持续的形态特征」。它不是在看点,而是在理解声波如何随时间流淌和衰减。
另一位测试者的演示更惊人:他让模型识别《星球大战》中光剑挥舞的声音——GPT-6同样零样本猜中!虽在学术界,早有人尝试用频谱图训练专用模型检测鲸声,但这是通用大模型首次被公开证实,能在无专项微调的情况下完成这种跨模态推理。
人类的感知世界有巨大局限:我们靠耳膜接收震动,大脑才把物理震动转化为「声音」。在我们的潜意识里,声音就是用耳「听」的,图像就是用眼「看」的——这是几百万年进化设定的感官壁垒。
早期多模态AI是在模仿人类:给它听音频、看图片,试图像人一样理解。但GPT-6的意义在于:大模型正摆脱人类生物器官的束缚!
对GPT-6而言,深海蓝鲸的鸣叫和绝地武士的光剑声,本质上没区别——它们都是物理世界中能量的波动形式。当波动被转化为频谱图这种数学几何表达时,GPT-6可以直接「阅读」物理规则本身。它不需要耳朵,不需要「听」见,它可以直接「看」懂声音的物理公式。
今天它看图认出蓝鲸;明天,给它看地震波图像,它能不能预测断层破裂?给它看脑电波图,它能不能读出你在想什么?人类通过肉身感受宇宙的投影,而AI,正在直接阅读宇宙的源代码。
说了这么多,你会第一个用它来做什么样的网站?评论区聊聊你的脑洞!如果这篇文章让你感到震撼,点个「在看」+「分享」,让更多朋友看见AI这一夜的变化!