能力
不需要懂电脑,也不需要学任何指令。像交代同事一样告诉它要什么。
自己看内容、自己建目录、自己归类。几千个文件也是一句话的事。
跨几十个 Excel 提数、合并、算总数,不用一格一格复制。
给它参考文件和大概意思,它出初稿,你改细节。
可以固定成专门角色,孩子打开就用,不用每次重新交代。
合同、说明书、系统报错,截图或文件丢给它,讲给你听。
这本来就是它最强的领域。家里有人学编程的话正好用得上。
性能
Terminal-Bench 衡量的是「让 AI 自己操作电脑完成任务」的能力, 正好是这套方案的用法。数据来自各家官方模型卡。
这个成绩来自 7 月 31 日的正式版更新。同样的模型结构, 重新训练之后,实际动手能力(DeepSWE)从 7.3 分跳到 54.4 分, 安全攻防(CyberGym)从 38.7 涨到 76.7,工具调用(Toolathlon)从 49.7 涨到 70.3。
这次更新还让它原生支持了 Codex 的接口。 这是为什么现在装起来干净利落,中间不需要任何转换层。
流程
全程一小时以内,你只需要在旁边看着。
你的电脑型号、平时想用来做什么。不合适会直接说,不浪费你时间。
配置、安装、调试,全套做完。你不用准备任何东西。
用你自己的文件跑一遍。你确认能用,我才走。
比如孩子的英语陪练,打开就能用,不用每次交代背景。
之后按实际用量付费,充 10 块能用很久。 这笔钱直接付给模型服务商,不经过我。
先说清楚你的电脑情况和想用来做什么,合适再约时间。
装不成不收钱 · 成都远大中央公园及周边上门