AI能做什么?

全能翻译官、打杂小秘书、画画、原型、作曲、编程、3D建模、二创视频……

首页做了个AI魔方,更“一览无余”,但是好像有人说看不太懂……

注意更新时效

程序:新编译器

不只是软件编程,是所有。比较高危的是逆向、渗透。

套餐选择。只看编程,目前20美元、100美元套餐,Claude性价比较高(除非你特别喜欢GPT Image 2.5画界面)。200美元套餐自行判断,Codex 200美元套餐是二十倍额度(后续将改为十倍),且浏览器Pro模型次数较多;Claude 则是10倍周额度,20倍5小时额度。

我实测的“纯AI执行项目”:

  1. 2026年8月,AIY;
  2. 2026年7月,AI执行已经完全可行,模型纪年 ,Codex Micro Keypad模拟器与Agent Controller(用手柄控制Agent);
  3. 此前还是比较玩具的项目。比如:Gemini 3 Pro 仿古打字机。

Gantrol 公开项目

文员

  1. 各类翻译、转化问题
  2. 如英译中、用小红书或微博风格重写、读取图片中的文字(OCR),目前Gemini这方面能力突出
  3. 处理“PPT视频课程”,现在Gemini已经可以处理Youtube视频,更能配合Chrome浏览器。
  4. 查找类
  • 从一些资料中找出想要的段落,可以是比较模糊的语言。如果资料超过大模型上下文,选择国外NotebookLM、Codex;国内考虑WorkBuddy、ima.copilot;如果没超过大模型上下文,可以考虑用Gemini 3.8 Flash;
  • 根据图片找出地理位置定位
  • 找来源
  1. **“套路文”编写。**如角色扮演、公文、高考作文(例文)、社交媒体上的通稿等
  2. 检查

作画

矢量图、SVG、图标等,用GPT 6。

教程是通用的。另外顶尖模型已经能很好理解中文要求,不需要结构化的指令(如JSON),甚至能帮你生成指令。

  1. ChatGPT画图。GPT Image 2.5断档第一,另有去背景能力(可能GPT Image 2跟1.5才有);
  2. Gemini绘画。【目前是Nano Banana Pro跟2】画三视图、UV图这种转化,比GPT Image强;
  3. (带教程)与 Midjourney 对话:画猫
  4. (国产)豆包,随意提要求即可

顺带一提,ChatGPT跟Gemini绘图都有官方检测工具,就算经过一些简单处理,也能检测出来。ChatGPT是Verify OpenAI-generated images,Gemini则要自己去应用对话,附上图片,然后问一句“检测改图片是否AI图”。

有趣的是,过于简单的图片,Gemini可能会拒绝检测,可能是怕被检测逆向水印算法。

视频

  1. 文生视频,目前还是二创水平,复刻视频还不错。但还需要抽卡。最好会分镜跟剪辑。
  2. 详见视频生成模型,或者瞄一眼这篇花两天半肝出来的微动漫实战经验,另有仿真人的视频。
  3. 此前看一些“原创”视频,无一例外,分镜是“垫”的。不知道会不会事后清算。
  4. GPT Image 2.5有一定逐帧生成能力。
  5. GPT6如果能画出对应SVG,动图应该没有什么问题。
  6. 建模,加动画,需要详细图纸,见「3D建模」一节。
  7. Claude Opus 5.5做建模、知识类视频的能力也赶上来了。

3D建模:图纸型

ChatGPT 6 Pro只要有精确图纸、公式,几乎就能画出。其他地方则需要人类,“几乎”之外,也需要人来做。

下图是一例生成的V8发动机,图纸也是GPT 6 Pro自行找的,隐藏了一部分零件,方便看确实有八缸。

image.png

作曲

  1. Suno 如何作乐
  2. Suno 如何调整风格

能取代人吗?

大模型不像珍妮纺织机,一下子从生成一根棉线变成十根。更像是蒸汽机,提供“智能动力”。但这个动力用在哪、有没有用、浪不浪费、稳不稳定,是另一回事。

大模型是“智能发动机”。你要有“数据铁路”给它跑。

假设你的工作只跟电脑数据相关,任务难度也没超过大模型能力,数据到大模型的路也是通的,那么就相当危险。

但貌似没怎么看到这类工种。但有趣的是,因为AI裁员的消息不断——成功地把负面新闻变成略带正面的,换你、你也用这个借口。

最近形势确实不好,得等大模型发展起来,需求旺盛起来,从蒸汽机到内燃机,数据道路也畅通,甚至发明了新的“流水线”。到时,会有不少工作。

那人呢?

  • 观念极其重要。“Deepseek语文那么好,我为什么还要练写作” (数学、英语等同理)
  • 决策与先验。好的观念能帮你预判,小到判断一则信息,大到人生、替群体决策。我们没有精力逐条检验,如果能事先判断,那么将大幅节省。调研品、小型试验等都有助于决策。
  • 指导别人执行,然后验收。

小结

AI生成内容,都有浓烈的“自嗨”属性。喜欢的人在创作时简直停不下来。但外人不一定喜欢,甚至不少人认为AI生成内容很廉价。

这些内容可能不会占据原有生态位,但会演变出新玩法、新生态,大势不可挡。

目前大伙比较宽容的是各类二创、段子。而且这些领域,以前“产量”也不够,受众嗷嗷待哺。

对个人来说,大模型边界,即语言边界,也是表达及格线。

废弃