猫眼影戏
猫眼影戏
普罗泰·米塔利
手机审查
猫眼影戏记者 邢广程 报道Q8X2R7L1T4J5M9B6W3
今天破晓宣布的 GPT-5.3-Codex 可以说是 OpenAI 对这段时间来,种种外地 Agent 爆火的一记重拳回手,虽然主要是对 Anthropic 的还击。
配合 OpenAI 前几天的宣布的 Codex 桌面版应用,Skill、Cowork、Claude Code,甚至是 Openclaw,这些热门工具能实现的功效,现在通过 Codex 的外壳 + GPT-5.3-Codex 模子能力,都能做到了。
▲ 在 Codex App 内可以直接选择 GPT-5.3-Codex 模子,也能选择深度思索的强度
和之前先容 Cowork 的能力一样,我们也丢了一些类似的使命让 Codex 来完成,像是直接处置惩罚外地文件、种种名堂转换、挪用差别的 Skills 组合能力、做 Word/PPT/Excel、下载视频、开发 App……
GPT-5.3-Codex 的体现确实亮眼,相较量重新最先装置 Claude Code,对新人用户来说,现在直接下载 Codex 会是一个更好的选择。这也是未来模子厂商的一种趋势,一最先各人都是从黑乎乎的下令行终端最先做外地 Agent,接着都逐步回归到可视化的友好界面。
网上对 Codex 的评价在这几天也有了不少逆转,许多开发者从 Claude Code 转向 Codex,一些在海内的自力开发者也体现 Codex Plus 会员就可以用,并且还不会像 Claude 那般总是无情封号。
奥特曼更是激动的宣布,Codex 的活跃用户已经凌驾 100 万。在模子更新博客,也是绝不掩饰和留有余地的夸赞,
GPT-5.3-Codex 是我们第一个能够自我构建的模子。通过使用 5.3-Codex,我们能够以云云快的速率宣布 5.3-Codex。
跟 Claude 团队用两周的时间,使用 Claude Code,100% AI 代码,搓出一个 Cowork 一样;尚有 OpenAI 去年年底宣布的文章,「使用 Codex 在 28 天内构建 Android 版 Sora」,Agent 的时代真的来了。
用 Codex 取代我的 ChatGPT 和 Claude Code
和大大都的外地 Agent 一样,无论是终端照旧 Cowork,我们都是先选择一个事情文件夹。在 Codex 中,我们可以建设多个 Project,选择对应的文件夹,再进一步最先对话,Codex 把它们叫做 Threads 线程。
先用最普遍和简朴的例子,我们添加了一个空的下载文件夹,然后点击最先一个线程,选择 GPT-5.3-Codex 模子;就像在 ChatGPT 内里对话一样,输入指令。
要求它帮我们下载一个 X 视频,Codex 会自动检查可用的 Skills 来处置惩罚,接着通过 yt-dlp 工具举行下载,这个视频有四个多小时长,Codex 会一直在对话框里自动更新下载进度。
▲GIF 图经由加速处置惩罚
视频下载后,我们还可以要求它提取视频的逐字稿,给我们一份双语版本的文档,最后让它把整个流程打包为一个 Skill,利便下次使用。
若是视频中有一些较量有意思的片断,想要裁剪视频,或者是把裁出来的视频转成 GIF 图,在 Codex 里都能做到。
例如,我们这里下载了一个视频,然后要求它把视频的 5s-25s 裁剪出来成为一个新的视频;得益于 GPT-5.3-Codex 的 Token 快速处置惩罚,整个历程不需要很长时间,反而更多是取决于外地电脑的硬件解码编码能力。
▲ GIF 图经由加速处置惩罚
或者我们也可以直接要求它把视频的前 5s 转成一个 GIF 文件,并且确保巨细在 10MB 以内,帧数可以自行调解,清晰度上将宽度控制在 640px。
很快,我们就能获得对应的 GIF 文件。更极端一点,还能让它把整个视频转成图片,每秒 30 帧,每一帧就是一张图。
这些对外地文件的直接处置惩罚,和 GPT-5.3-Codex 在 Terminal-Bench-2 测试集上的优异体现,让 Codex 基本上能知足种种生产力工具、效率工具的功效实现。
作为比照,同样是刚刚宣布的 Claude Opus 4.6 在 Terminal-Bench 2.0 上得分是 65.4%,GPT-5.3-Codex 是 77.3%。
▲ 图片泉源:https://x.com/neilsuperduper/status/2019486017703547309/
例如在这个文件夹中,有多张图片,我们首先是要求它凭证图片内容,对这些图片文件举行重命名,并坚持文件名不凌驾 20 个字母,不允许使用符号。
▲ GIF 图经由加速
自动修改完成后,我们还能要求他对这些图片举行拼接,无论是笔直拼接照旧水平,挪用对应的工具,Codex 都可以做到。
和 Claude Skills 一样,Codex 也能装置 Skills 市场上富厚的手艺,并且在应用内,就已经提供了包括 pptx、xls、word、canvas、notion 在内的多款手艺。
回到基础的编程能力,升级后的 GPT-5.3-Codex 体现也比 GPT-5.2 要好上不少。我们直接要求它写一个「逐日一词」的 App。和在 ChatGPT 内里直接用 Canvas 给我们一个带不走的网页差别,Codex 能在外地从零最先,完成项目,然后使用 Vercel 或 Cloudflare 等 Skills 安排到网页上。
这里我们选择的推理模式是 Extra High,超强推理模式,于是在每一步操作之前,GPT-5.3-Codex 都会询问我下一步的操作选择,这也和 Codex 内部能直接凭证使命情形,挪用差别 Skills 有关,其中的头脑风暴 Skill,会自动举行一直对话的模式。
最后,它基本上照旧完成了我一最先要求它完成的所有功效,并且还能进一步开发 macOS、iOS,和安卓版本。
若是我们有现成的代码项目,也可以选择该项目文件夹,在 Codex 中翻开,GPT-5.3-Codex 会剖析项目保存的 Bug,并且修复它。
在已往很长一段时间里,无论是工具照旧模子,开发者的首选着实都是 Anthropic 的 Sonnet/Opus 模子和 Claude Code 工具。OpenAI 在编程、尤其是长代码逻辑推理上的落伍,曾让不少开发者转投阵营。
GPT-5.3-Codex 的泛起,就是为了终结这场争论。现在 GPT-5.3-Codex 在编程基准测试和现实体现上,不但碾压了自家的前代模子,也确实有把友商模子按在地上摩擦的先兆。它真正具备了编写、测试和推理代码的能力。
做游戏项目,是这次模子先容博客里,网站开发部分主要案例,我们也让 GPT-5.3-Codex 做了一个简朴的物理弹球游戏,整体的效果虽然没有抵达我的期待,由于我在提醒词内里有说希望这是一个 RPG 的游戏,但 GPT-5.3-Codex 给我的界面照旧过于简陋了。不过,幸亏照旧能玩。
我们也在 X 上找到了一些用 GPT-5.3-Codex 做的小游戏,像这个类似超等玛丽的网络金币。
▲泉源:https://x.com/Angaisb_/status/2019548783869325331
强中更有强中手
对 Anthropic 来说,OpenAI 今天玩的这些,可能会说,这都是我们玩剩下的。无论是代码、或者 Agent 的能力,照旧最先着手去做外地 Agent,从之前 Codex 的终端转成现在的 macOS App。
在手艺的领域,OpenAI 似乎都是随着 Claude 的脚步在走,Claude 深耕代码能力,OpenAI 搞了 Sora、日报、浏览器、ChatGPT agent,都没什么水花,于是也在代码上发力;Claude 一月初推出 Cowork,OpenAI 也紧接着在仲春初宣布 Codex App。
就和今天的麋集宣布一样,破晓 1:45,Claude 官方发 X 推出 Claude Opus 4.6,紧接着就是 OpenAI 端上 GPT-5.3-Codex。两款模子着实都是为了给 Agent 更强盛的基座能力,以前是说代码/vibe coding,但现在 Agent 能做好,基本上都是「写代码写得好」。
Opus 4.6 虽然在 SWE-Bench 上的体现甚至不如 Opus 4.5,并且 Terminal-Bench 2.0 上的效果也没有 GPT-5.3-Codex 强,可是 Opus 破天荒地把上下文长度拉到了一百万 token 的窗口。并且,这些 benchmark 的体现还没有相差许多。
Claude 说,我的 Sonnet 5 还没上来,那才是真功夫。
我们在网上也找了一些 Opus 4.6 最新的测试案例,有网友说 Claude 4.6 Opus 只是一次挪用,就完全重构了他的整个代码库,将原来杂乱的代码「屎山」所有?榛,并且没有模子能像 Opus 这样做到。
尚有网友拿 Opus 4.6 和 4.5 举行比照,让两个模子玩统一款谋划游戏,看谁的账户品级、财产和装备更高。测试博主提到,4.6 版本在初期制订战略的时间更长,可是做出了更好的战略决议,并且在最后确实做到了遥遥领先。
尚有网友也做了一个游戏,不过是一个宝可梦的克隆版。博主提到这是他用 AI 做出来的最酷的工具。他提到,Claude Opus 4.6 思索了 1 小时 30 分钟,使用了 11 万个 Token,并且只迭代了三次。
▲ https://x.com/chatgpt21/status/2019679978162634930
在 CLaude 官方演示和早期用户的反响中,也提到了一个 Opus 体现优异的案例。Opus 4.6 在一天内自主关闭了 13 个 issue,issue 即项目保存的待解决问题,并将另外 12 个 issue 准确分派给了准确的人类团队成员。
和 Kimi K2.5 的智能体蜂群一样,Opus 4.6 也能治理一个 50 人规模组织的代码库。在 Claude Code 中,我们可以组建 Agent Teams,召唤出一整个步队的 AI,不再是一个 AI 在战斗。这些AI 可以有的认真写代码,有的认真 Review,有的认真测试,它们之间自主协作。
也有网友测试了 Claude Code 内里的 Agent 蜂群,提到启用蜂群之后的 Opus 4.6,速率提升 2.5 倍,并且效果也更好。
我们现在的状态就跟这张图片一样,虽然一山比一山高,但都绕不出这个圈。前几个月可能是 Gemini 赚走了风头,一月份来,应该是 Claude,然后看样子又要轮到 OpenAI,或者马斯克的 Grok。
幸亏这个循环的历程中,作为用户的我们,能显着感受到 AI 的能力一直在变强。
GPT-5.3-Codex 的 API 还没有开放,缘故原由是模子太强了,会保存很大的危害,以是 OpenAI 还在思量怎么清静地启用 API。
Claude Opus 4.6 已经可以在 Claude 通用谈天应用、Claude Code、API 多种方法使用,这两个作为今年外洋御三家首发的两款模子,很是值得一试。
未来,更好的效劳 Agent,让 Agent 为我们做事,还会是大模子更新的重点。
??时势1:超碰天天日
??02月08日,鲁台经贸合作成果丰硕 山东实际使用台资306.83亿美元,
同砚们,“清静无小事”,“隐患就是事故”,生命是云云优美,生涯又是云云的多姿多彩。让我们珍惜生命、热爱生涯,时刻强化清静意识,起劲增强自我提防能力,为自己撑起一片清静的蓝天。让我们在国旗下配合祝愿,祝愿我们生涯随处开满清静之花,祝愿我们清静康健度过生命的每一天。
,男人将坤放在女人定眼中视频。??02月08日,2025春节机票搜索量暴涨2.2倍 除夕当天多条航线经济舱全价,
“青大婶,要小心啊,下面很多多少凶兽。”
,2019无码专区人妻系列,亚洲电影一区,东北丰满少妇多毛大隂户。??时势2:本地毛片
??02月08日,日本东京7月共123人中暑死亡 没开空调是主因,
“你……”
,九九人人,人人澡超碰碰,有马芳彦skill我不想分手在线播放。??02月08日,第六届浙江国际智慧交通产业博览会在杭州开幕,
八是明确了学校清静的重中之重。与学校签订了《校园清静事情目的责任书》和《学校清静卫生事情责任书》,层层把关,责任到人,坚持按期排查整改,并下发了有关学校清静事情的若干文件,整年没有泛起清静事故。
,十八禁美女,啊哈用力嗯快点啊视频,黄色一级片特黄持色二室二厅。??时势3:中文字幕97超碰 伊人
??02月08日,北京市文联携手门头沟建设“诗画乡村”,
“太狠毒了,连老人和孩子都不放过!”
,午夜三级永久久久,国产国语对白在线高清视频,欧美做受XXXⅩ高潮喷水漫画。??02月08日,下一个能让C罗记住的中国球员,在哪里?,
在隆隆声中,成片成片的参天大树折断,许多都是十几人才华合抱过来的粗大巨木,青鳞鹰直接俯冲而过,铁翅击断一切障碍物,满地都是枝桠与乱叶。
,亚洲国产欧美在线人成Aⅴ,亚洲AAA 视频,欧美三级视频观看。??时势4:老师 狂揉下部
??02月08日,亚洲杯1/8决赛:日本胜巴林 伊朗点球淘汰叙利亚,
??02月08日,广西梧州:西江冬季航运忙,
“算了,将卵还给那头没毛的大鹰吧。”一位族老说道。
,亚洲一区图片小说综合网,欧洲尤物美女性爱精点视频免费看,黄色一级黄片视频。【国产大飞机C919开始执飞“京陕快线”】
责编:王茂亮
审核:小林正好
责编:杜宇
Copyright (C) 2001- dzwww.com. All Rights Reserved
新闻信息效劳允许证 - 音像制品出书允许证 - 广播电视节目制作谋划允许证 - 网络视听允许证 - 网络文化谋划允许证
山东省互联网传媒集团主理 联系电话:0531-85193202 违法不良信息举报电话:0531-85196540
Copyright (C) 2001- Dzwww 鲁ICP备09023866号-1