「用 AI 一周写完项目,上线第一天就崩」,我一点都不意外

简介: AI 降低了写出代码的门槛,但边界情况、一致性、可解释性它补不了。教育系统里我刻意用规则引擎而非大模型,讲清该不该上模型的三个判断问题。

"用 AI 一周写完项目,上线第一天就崩",我一点都不意外

本文作者:李玉涛(Leo),长春师范大学 数据科学与大数据技术专业 2027 届本科生,辅修数学双学位。
个人主页:一.chat(一.chat)| GitHub:Leo-Li638(Leo-Li638)

最近技术社区里有个帖子很火:有人用 AI 一周写完了整个项目,结果上线第一天就崩了。评论区一半在感慨"AI 太猛",一半在感慨"果然如此"。

我的反应是:不意外。而且我想讲一个可能有点反直觉的案例——我在一个教育系统里,刻意没有用大模型,而是用纯规则引擎做了核心功能。

一、为什么有人一周就能写完一个项目

先说句公道话:AI 确实大幅降低了"写出代码"的门槛。需求描述清楚,脚手架、CRUD、页面,一天出个能跑的 Demo 很正常。

但"写出来"和"能上线"之间,隔着的东西恰好是 AI 最不擅长的:

  • 边界情况:用户输错、网络抖动、并发写同一份数据,AI 生成的代码默认路径很顺,异常路径常常是空的。
  • 一致性:状态和流水对不上、缓存和数据库不一致,这类 bug 不会在 Demo 里出现,只在上线后出现。
  • 可解释性:出了问题,你得知道"为什么是这个结果"。

一周写完的项目上线就崩,崩的往往不是功能,是这三件事。

二、我的选择:教育场景里不用大模型

我做过一个 K12 教学管理平台(SmartClass),核心功能是"根据学生的做题情况,推荐他该练的薄弱知识点"。

很多人第一反应是"这不就是推荐系统/大模型该干的事吗"。但我最终用的是纯规则引擎,理由有三条:

  1. 数据量不支持。单校场景的练习流水撑不起协同过滤的稀疏矩阵,硬上模型只会输出玄学。
  2. 教育场景要可解释。老师和学生需要知道"为什么推这道题"——"你的《一元二次方程》掌握度 42%,低于班级均值,推荐 3 道专项题",远比"模型觉得你该做这道"可信。
  3. 零外部依赖。不调任何外部 AI 服务,离线可跑,成本为零。

引擎的核心是两个基础数学工具:用拉普拉斯平滑估计掌握度(避免"做 1 题对 1 题 = 100%"的小样本抖动),用艾宾浩斯遗忘曲线对历史练习做时间衰减(久不复习的知识点自然沉底)。数学双学位在这里第一次直接变成了工程产出。

三、可解释不是一个加分项,是某些场景的及格线

在推荐商品、生成文案这类场景,"效果好不好"就够了。但在教育、医疗、金融这些场景,"为什么"和"结果本身"一样重要。

AI 是工具,不是银弹。判断一个功能该不该上模型,我的经验是问三个问题:

  • 数据量够不够支撑模型?不够就别硬上。
  • 结果需不需要向用户解释?需要的话,可解释性优先。
  • 出错成本高不高?高的话,规则兜底比生成更稳。

三个都是"否",那用 AI 提效没毛病;只要有一个是"是",就该先想清楚怎么兜底。

四、写在最后

"一周写完"本身不是问题,"一周写完就敢上线"才是。AI 把生产力拉满了,但没有替你补齐工程判断——那部分还得自己来。


这个项目的完整复盘和代码都在个人主页 一.chat(一.chat) 上,源码在 GitHub(Leo-Li638)。对 AI 落地的边界问题感兴趣的话,欢迎交流。

李玉涛(Leo)· 长春师范大学 · 数据科学与大数据技术 + 数学双学位 · 2027 届

相关文章
|
8天前
|
人工智能 JSON API
全网刷屏的 Jev 模型正式开放!一手实战测评 + 保姆级教程
全网爆火的 Jev 模型是什么?有什么用?怎么使用?怎么接入 AI 编程工具?效果真的好么?傻子可懂的 Jev 保姆级实战教程 + 项目实战测评来啦
7316 12
|
6天前
|
人工智能 测试技术 API
最近全网爆火的 Jev 到底是什么?适合干什么、怎么用,一篇讲透!
Jev是TypeSafe AI推出的“系统一模型”,不生成文本,专做毫秒级结构化决策:Choice(多选)、Score(打分)、Noul(是非概率)。响应快193倍、成本低444倍,适合工单路由、内容审核、测试定级等高频判断场景。
1520 4
最近全网爆火的 Jev 到底是什么?适合干什么、怎么用,一篇讲透!
|
6天前
|
人工智能 并行计算 PyTorch
秋叶 ComfyUI 2026 整合包 v3.2 完整部署教程:Python 3.13 + Torch 2.13 全栈升级
秋叶aaaki ComfyUI 2026年8月整合包v3.2正式发布!全面升级Python 3.13.11、PyTorch 2.13.0+cu130及ComfyUI v0.30.2,原生支持MiniMax H3、Wan 2.2、Qwen-Image-2.1等2026主流音视频/图像模型,解压即用,无需环境配置。
965 7
|
3天前
|
人工智能 JavaScript 芯片
DeepSeek 官方偷偷上传 Harness 桌面端安装包,我已经用上了。。附最新下载地址
DeepSeek Harness 官方的桌面端安装包被网友扒出来了,2 分钟讲明白如何使用,体验如何,适合作为 AI 编程工具么?附最新 Windows 和 Mac 双端的下载地址
1140 1
|
20天前
|
人工智能 自然语言处理 安全
阿里云千问办公 QwenWork详细介绍:产品核心能力、典型场景、价格及常见问题解答
千问办公是阿里云推出的一站式AI办公平台,主打"不止于对话,更注重交付",依托通义千问旗舰大模型,用户一句话即可完成数据分析、PPT生成、视频剪辑等复杂任务,直接输出可用成果。产品深度打通钉钉生态与企业OA,覆盖桌面端、网页端,提供企业标准版198元/人/月等多档订阅方案,新用户注册即赠2000积分,适配工程师、HR、财务等多职业办公场景,成为能动手干活的"全能AI同事"。
3556 10
|
14天前
|
缓存 IDE Java
【保姆级】Android Studio下载、安装和汉化教程(2026最新)
Android Studio 是 Google 官方推出的免费 Android 应用开发集成环境,基于 IntelliJ IDEA,内置模拟器、调试器、性能分析及 Compose 界面工具,功能全面,文档丰富,是安卓开发首选工具。(239字)
1587 1
|
4天前
|
编解码 缓存 PyTorch
16G 显卡能跑 Qwen-Image 2.1 吗?
9月20日,阿里Qwen开源Qwen-Image-2.1:7B DiT图像模型+8B文本编码器+VAE,单模型支持文生图与图像编辑,原生输出2K PNG(含Alpha通道),支持10张参考图。在自建Qwen-Image-Bench达60.28分(开源模型第一),GenAI Showdown文生图排名7/15。16G显存可跑1024×1024(需INT8量化+ComfyUI优化),但2K需24G以上。注意其Qwen Research License限非商业用途。
491 1
|
5天前
|
人工智能 编解码 并行计算
MiniMax-H3 一键整合包技术文档:8G 显存运行 AI 漫剧制作 —— 角色替换 / 动作迁移 / 文图生视频部署与调参指南
MiniMax H3 是 MiniMax 开源的全模态视频生成模型,支持文/图/音/视多条件输入,输出最高2K、15秒带双声道音频视频。本文档详述其Int8量化版在8GB显存下的本地一键部署、三段式工作流(EDIT/REPLACE/CONTINUE)、参数调优及常见问题排查。(239字)

热门文章

最新文章