OpenAI 宣布全新的 ChatGPT 桌面应用现已在全球范围内推出,支持 macOS 和 Windows 系统。它将 Chat(用于提问和对话)、Work(用于研究和交付成果)以及 Codex(用于软件开发)功能整合到一个应用中。
在桌面端,Work 可以在获得您的许可后使用本地文件和桌面应用程序。内置浏览器使 ChatGPT 能够从网站收集信息,并与受支持的基于 Web 的工具和文件配合使用。Codex 还增加了差异对比中的内联编辑、侧边栏中的拉取请求审查、更快的计算机使用速度以及对单个项目中多个代码库的支持。
如果您已在使用 Codex 应用,请按常规方式更新以迁移到新的 ChatGPT 桌面应用。如果您使用的是旧版 ChatGPT 桌面应用,请按照应用内的提示下载新版本。旧版应用可以保留,名称为 ChatGPT Classic。ChatGPT Classic 将继续获得模型更新、错误修复、安全补丁以及对其现有企业功能的支持,而 Work 和 Codex 等新的 Agent 功能则在新应用中提供。
此外,ChatGPT Atlas 浏览器将于 8 月 9 日被终止。在此之前,请导出或保存任何重要的 Atlas 数据,包括您想要保留的书签和页面。在此之后,Atlas 可能无法再打开、浏览或支持基于浏览器的代理工作流程。如需更深入的 Agent 浏览器操作,请尝试使用全新的 ChatGPT 桌面应用程序。它旨在支持 ChatGPT 中更强大的基于浏览器的 Agent 工作流程,包括多标签页、下载、改进的导航、账户登录支持以及其他相关的浏览器改进。如需在 Chrome 浏览器中使用,请尝试使用 ChatGPT Chrome 扩展程序或侧边栏。
via 匿名
特朗普政府要求 OpenAI 分阶段发布 AI 模型
彭博社称,据一位知情人士透露,特朗普政府已要求 OpenAI 分阶段发布其即将推出的一款强大的 AI 模型。此前,OpenAI 的竞争对手 Anthropic 也在监管压力下暂停了其最强大模型的市场投放。
知情人士表示,OpenAI CEO Sam Almtan 周三告诉员工,美国政府要求公司先将 GPT-5.6 向一小部分受信任的合作伙伴开放,然后再更广泛地推出。Almtan 在与员工的会议上表示,美国政府对最前沿模型的能力越来越感到担忧。Almtan 强调,员工需要就特朗普政府官员可能对 OpenAI 即将推出的模型,在安全性和使用限制方面提出的任何意见进行配合,即使公司持有不同的意见。
via 匿名
🗒 标签: #OpenAI #AI
📢 频道: @GodlyNews1
🤖 投稿: @GodlyNewsBot
彭博社称,据一位知情人士透露,特朗普政府已要求 OpenAI 分阶段发布其即将推出的一款强大的 AI 模型。此前,OpenAI 的竞争对手 Anthropic 也在监管压力下暂停了其最强大模型的市场投放。
知情人士表示,OpenAI CEO Sam Almtan 周三告诉员工,美国政府要求公司先将 GPT-5.6 向一小部分受信任的合作伙伴开放,然后再更广泛地推出。Almtan 在与员工的会议上表示,美国政府对最前沿模型的能力越来越感到担忧。Almtan 强调,员工需要就特朗普政府官员可能对 OpenAI 即将推出的模型,在安全性和使用限制方面提出的任何意见进行配合,即使公司持有不同的意见。
知情人士称,GPT-5.6 最初将向 20 家合作伙伴开放,并补充说,获取该模型的途径之一将是亚马逊的 Bedrock 平台。OpenAI 拒绝置评。一位白宫官员表示,特朗普政府将继续与前沿 AI 实验室合作,共同制定应对技术规模化挑战的方法。The Information 此前曾报道了此次会议的部分细节。
本月早些时候,美国政府以国家安全为由,下令 Anthropic 限制公众使用其最先进的两款模型。此后,Anthropic 关闭了全球用户对 Mythos 5 和 Fable 5 的访问权限。Anthropic 随后一直在与美国政府进行谈判,试图恢复这些模型的访问权限。
美国政府这一前所未有的举措,凸显了特朗普政府展现出的对快速发展的 AI 行业施加管制的意愿,也为企业敲响了警钟。与 Anthropic 一样,OpenAI 一直在竞相部署在编程到网络安全等各项任务上更为擅长的新模型。知情人士透露,OpenAI 员工也担心,政府对 Anthropic 采取的行动,可能会影响 OpenAI 大规模推出其技术的能力。
一位知情人士表示,目前,各家 AI 实验室只能自行制定临时流程,向政府通报即将推出的强大 AI 模型。在推出新 AI 模型之前,目前并不清楚应向政府中的哪些部门进行通报、何时通报、应分享多少细节,以及应在发布前多久进行通报。知情人士表示,一些人士希望,特朗普本月初签署的一项行政命令能够使这一流程更加明确,该行政命令要求特朗普政府和 AI 公司在签署后 60 天内制定一套自愿框架,其中包括允许政府在前沿模型计划发布前最多 30 天获得这些模型的访问权限。
via 匿名
聪明人的分工:让昂贵模型做规划,便宜模型去执行
知名开源开发者 shadcn 刚刚开源了一个全新项目——improve。
这是一个非常巧妙的 Agent Skill,它的核心理念是:用你最聪明(也最昂贵)的 AI 模型来做高杠杆的脑力劳动(审计代码、写技术方案),然后把脏活累活(编写代码、跑测试)交给更便宜的 AI 模型去执行。
这个工具本身绝对不会直接修改你的一行代码,它的产出就是一份清晰、可执行的 Markdown 格式实施方案。
💡 它是如何工作的?
1. 项目审计 (
2. 制定方案 (
3. 分发执行 (
🚀 核心指令一览
•
•
•
•
•
安装方式
项目支持 Agent Skills 规范:
https://github.com/shadcn/improve
#AI开发 #智能代理 #软件工程 #GitHub开源 #shadcn
知名开源开发者 shadcn 刚刚开源了一个全新项目——improve。
这是一个非常巧妙的 Agent Skill,它的核心理念是:用你最聪明(也最昂贵)的 AI 模型来做高杠杆的脑力劳动(审计代码、写技术方案),然后把脏活累活(编写代码、跑测试)交给更便宜的 AI 模型去执行。
这个工具本身绝对不会直接修改你的一行代码,它的产出就是一份清晰、可执行的 Markdown 格式实施方案。
💡 它是如何工作的?
1. 项目审计 (
/improve):高阶模型会深度扫描并分析你的代码库,指出潜在的 Bug、性能瓶颈、安全隐患或技术债,并产出一份按“投入产出比”排序的发现清单。2. 制定方案 (
plans/):当你挑选出需要解决的问题后,高阶模型会针对每个问题输出一份极其详尽的方案(Plan)。这些方案是“自包含”的,带有明确的验证命令、执行边界和异常中止条件(STOP conditions)。3. 分发执行 (
/improve execute <plan>):你可以把这些高可读性的方案直接扔给任何便宜的轻量级 AI Agent。轻量级模型只需像个机械的执行者一样,按照步骤修改代码、运行测试,最后向你提交 Pull Request。🚀 核心指令一览
•
/improve:全局审计并输出优化点。•
/improve quick:快速扫描重点。•
/improve deep:对每个包、每个分类进行详尽审计。•
/improve plan <description>:跳过审计,直接为指定任务编写执行方案。•
/improve execute <plan>:派发给便宜的执行器模型并审核其成果。安装方式
项目支持 Agent Skills 规范:
npx skills add shadcn/improve
https://github.com/shadcn/improve
#AI开发 #智能代理 #软件工程 #GitHub开源 #shadcn
CodeGraph 是一个专为 Claude Code、Cursor、Codex、OpenCode 等 AI 编程 Agent 打造的预索引代码知识图谱工具。
它能让 AI 不再每次都通过 grep、read、explore 盲目扫描代码,而是直接查询一个语义化知识图谱,实现更快、更省、更准的代码理解与开发。
📮投稿 📢频道 💬吹水 🌐网站
这是一款提供全天候免提协助的智能眼镜,将于今秋上市。
新款音频眼镜可让 Gemini 随时为你提供帮助,比如拍照、在新城市导航,或将音频内容进行实时翻译。Audio Glasses支持与 Android 及 iOS 手机配对使用。
• Gemini 月活用户达9 亿
谷歌搜索现在由Gemini 3.5加持、具备大规模执行任务能力
该功能将先向 Google AI Pro 和 Ultra 订阅用户逐步推出
Google 推出CodeMender API,一种代码安全代理,可自动发现并修复关键的软件漏洞。
今天,我们将邀请一小部分精选专家来进行测试,并计划很快更广泛地推出。
面向科学的 Gemini,旨在加速科研进程
Gemini 已经可以帮助解决复杂问题,而我们全新的 GoogleLabs 原型还能进一步简化更多日常科研任务,包括:
• 跟进最新论文
• 把研究目标转化成可直接使用的代码
• 生成新的假设
AI 模拟是面向科学的中另一个强有力的工具,能够帮助我们理解并预测动态系统。
Google 推出Google Pics
Google Workspace 新增一款全新产品,让你获得更强的创作掌控力。
这是一款图像创建与编辑工具,几乎能帮你做出任何想要的作品——比如派对传单和信息图表。它会自动识别并分割照片中的各个对象,理解它们之间的关系,让你只需点击几下就能轻松完成编辑。
Pics 将于今天先向一小部分“可信测试员”开放,随后在今年夏天晚些时候,面向全球的 Google AI Pro 和 Ultra 订阅用户推出。
Stitch by Google现在能够实时生成移动端和 Web 应用的界面(UI)
今天起开始免费向全球用户逐步推出。
你可以让 Stitch 根据你的提示设计一款移动端应用,并通过语音和文字编辑备注对设计进行打磨——就像和设计伙伴协作一样。准备上线时,可将设计导入 Google Antigravity 或 GoogleAIStudio ,并进行发布。
Google Flow多项更新
• 新增Gemini Omni Flash:只需提供简短提示和风格参考,Gemini Omni 就能在保留原始性能的同时,改变现有场景的环境,添加视觉效果及其他元素。
• 新增Google Flow 代理:集成Gemini 的智能代理能力,现在你的智能体可以同时执行多个操作。该代理还能凭借对上下文的精准理解,完成大规模编辑任务。
• 新增Google Flow 工具:现在你可以为任何你想到的创意工具“尽情编写代码”,比如设计视频特效或手绘动画。你还能在Google Flow上直接创建、分享并对这些工具进行再创作(remix)。
• 新增Google Flow Music:还在脑海里挥之不去的旋律?现在你可以在 Google Flow Music 上创作自己的歌曲。你只要把即兴创作录进 Google Flow Music,并用你想要的音乐风格来给它下指令——比如更精致的 R&B。Google Flow Music 会先给你打好基础,之后你就能直接在这个工具里继续微调完善。
新增 Universal Cart(环球购物车),Google 上全新的购物中心
你可以在Google引擎、Gemini App、YouTube或Gmail购物时,将商品添加到购物车。
系统将查找优惠和降价信息,给你带来价格历史的洞察,并在某件商品重新上架时及时提醒你。
它能帮你发现隐藏的优惠。由于它是基于 Google 钱包打造的,你的购物车会识别你的支付方式特权、会员/忠诚度信息以及商家优惠,这样你就不会错过任何优惠或积分。
• 通用商务协议(Universal Commerce Protocol:一项开源标准,它为代理和系统提供共同语言,使所有关键参与者能够携手协作。
• Agent Payments Protocol(AP2):让你的 AI 代理在明确边界与责任的框架下,安全地替你完成支付。
• Android Halo: 为你的代理在 Android 设备上提供的全新空间。今年晚些时候,它将让你一眼掌握各个代理的状态,从屏幕顶部就能直接看到他们的进展。Halo 将支持与 Gemini Spark 及其他兼容的智能代理协同工作。
▎Codex 登陆 ChatGPT 移动端:可在 iOS 和 Android 上查看、审批和控制编程任务
OpenAI 将 Codex 接入 ChatGPT 移动端。用户现在可以直接在 iOS 和 Android 的 ChatGPT App 中查看和控制 Codex 任务,不必一直守在电脑前。OpenAI 称,移动端 Codex 会连接到正在运行 Codex 的设备或远程环境,包括笔记本、Mac mini 或托管远程环境,并同步当前线程、审批、插件和项目上下文。
这次更新的重点在“远程接管开发流程”。用户可以在手机上查看 Codex 的实时工作状态,检查代码输出、批准操作、切换模型、继续已有线程,也可以启动新的编程任务。The Verge 报道称,本地文件、凭据和环境仍保留在用户机器上,手机端主要接收实时状态、截图和测试结果等信息。
Codex 的使用场景从“坐在电脑前写代码”已经进一步扩展到“让电脑或远程环境继续跑任务,人在手机上审批和跟进”。对于经常使用 AI coding agent 的开发者来说,移动端的接入极大程度上方便了处理长时间构建、测试、修复和代码审查流程。
频道 @AppDoDo 官推 APPDOTG
Multica 的核心理念是把各种编码 AI Agent变成真正的团队队友。
不再需要手动复制提示词,而是像分配任务给同事一样,把 Issue 指派给 Agent,让它们自主执行、汇报进度、积累技能。
➡️ Agent 即队友:每个 Agent 有独立档案、出现在看板上、能发表评论、创建 Issue、主动报告阻塞,像人类同事一样协作。➡️ 完整任务生命周期管理:自主认领、执行、实时进度推送(WebSocket)、完成/失败处理。➡️ 可复用技能系统:Agent 每次解决的问题都会变成团队共享的“技能”,让团队能力随时间持续增长。➡️ 多 Agent 多 Runtime 支持:兼容 Claude Code、OpenAI Codex、GitHub Copilot CLI、OpenClaw、OpenCode、Hermes、Gemini、Pi、Cursor Agent、Kimi、Kiro CLI 等,几乎覆盖主流编码 Agent。
📮投稿 📢频道 💬吹水 🌐网站
▎OpenAI 推出 GPT‑5.5,迄今为止最强的代理编码模型
OpenAI 于 2026 年 4 月 23 日正式发布 GPT-5.5,并将其定位为“面向真实工作的新一类智能”。官方表示,GPT-5.5 在理解复杂任务意图、跨工具持续执行、检查结果以及完成多步骤工作方面更强,重点能力覆盖写代码、在线研究、数据分析、生成文档与表格、操作软件等场景。
在编程能力方面,OpenAI 给出的数据称,GPT-5.5 在 Terminal-Bench 2.0 上达到 82.7%,在 SWE-Bench Pro 上达到 58.6%,并在其内部用于长周期编程任务评估的 Expert-SWE 上继续领先 GPT-5.4。官方认为,这意味着它在复杂命令行流程、真实 GitHub issue 修复、跨大规模代码库保持上下文、处理模糊故障和调用工具验证假设等方面更强。
在知识工作场景中,OpenAI 表示 GPT-5.5 在 Codex 里生成文档、表格和幻灯片的表现优于 GPT-5.4。公司内部团队已将其用于演讲请求分析、税务材料审阅和业务周报自动化等任务。官方还称,目前 OpenAI 内部已有超过 85% 的员工每周使用 Codex,涉及软件工程、财务、传播、市场、数据科学和产品管理等岗位。
GPT-5.5 已开始向 ChatGPT 和 Codex 的 Plus、Pro、Business、Enterprise 用户推出,GPT-5.5 Pro 则面向 Pro、Business、Enterprise 用户开放。OpenAI 同时表示,API 部署需要额外安全措施,正在与合作伙伴推进,GPT-5.5 和 GPT-5.5 Pro “很快”也会进入 API。
频道 @AppDoDo 官推 APPDOTG
在 Cloud Next 2026大会上,Google推出了“Workspace Intelligence”(工作区智能),旨在为每个应用提供“高度准确、个性化的上下文”。
该系统“理解复杂的语义关系”,涵盖 Gmail、Docs 及其他 Workspace 应用中的数据、你正在进行的项目、协作者以及其他公司特定的信息。Workspace Intelligence 利用 Google 的搜索能力和先进的 Gemini 推理来实现
• 信息收集:Workspace Intelligence 负责繁重的工作,为你收集正确的信息。它打破上下文壁垒,确保你在需要采取行动的瞬间就拥有所需的一切。
• 情境感知:借助高级的 Gemini 推理能力,Workspace Intelligence 能知道此刻对你最重要的是什么——确保你永远不会错过任何待办事项。
• 真正的个性化:通过理解你过去的工作和沟通模式,Workspace Intelligence 学会你的独特工作风格、语气和格式偏好,确保每一份输出都听起来像真正的你。
通过利用贯穿会议记录、电子邮件、文件等数字工作流的深层语义上下文,它创建了一个以你独特背景为基础的智能层,能够从根本上改变你的工作方式。
使用场景
你可以在Google Chat中向 Gemini 提问可以完成你交代的复杂任务,包括生成文档和幻灯片、根据描述搜索文件,以及在考虑所有人日程的情况下找出合适的会议时间。它还可以创建每日简报并与第三方工具集成,如 Asana、Jira 和 Salesforce。
在 Google Docs中,Gemini 可以使用 Workspace Intelligence 根据“你的业务数据”创建信息图。它可以同时编辑多张图片,“以在你的文档中创建视觉一致性”。另一项功能可以“对文档中的评论进行分类和回复,甚至根据评论反馈编辑你的文档”。
在 Google Slides 中,Gemini 利用 Workspace Intelligence 提供上下文信息,并严格遵循“贵公司的模板和视觉风格”,一次性生成幻灯片。在 Google Sheets 中,它用于以对话方式创建和编辑电子表格。
Workspace Intelligence 可从网络上检索您的相关电子邮件、聊天记录、文件和信息,将您的想法转化为专业格式的草稿,完美地模仿您的声音、品牌、风格和公司模板。
Google还发布了第八代TPU(张量处理单元)。今年的一个亮点是推出了“两种专为训练和推理设计的不同架构”。
TPU 8t(图左侧)用于训练,目标是将前沿模型的开发周期从几个月缩短到几周。与上一代相比,它在性价比上提高了 2.8 倍。其主要特性包括:
• 大规模扩展:单个 TPU 8t superpod 现在可扩展至 9,600 块芯片,配备 2 PB 共享高带宽内存,且芯片间带宽是上一代的两倍。该架构可提供 121 ExaFlops 的计算能力,让最复杂的模型能够使用一个巨大的统一内存池。
• 最大化利用率:通过将存储访问速度提升 10 倍,并使用 TPUDirect 将数据直接传入 TPU,TPU 8t 可确保端到端系统得到充分利用。
• 近乎线性扩展:借助我们新的 Virgo 网络、JAX 和 Pathways 软件,TPU 8t 能在单个逻辑集群内实现对多达一百万块芯片的近乎线性扩展。
TPU 8i(图右侧)用于推理或运行模型。它的每美元性能比之前提升了 80%,Google称这意味着公司可以“用相同的成本服务几乎两倍的客户量。”
• 打破“内存瓶颈”:为避免处理器闲置,TPU 8i 将 288 GB 高带宽内存与 384 MB 片上 SRAM 配合使用——比上一代增加了 3 倍——可以把模型的活跃工作集完全保存在芯片上。
• Axion 驱动的高效能:我们把每台服务器上的物理 CPU 主机数量翻了一番,采用了我们定制的基于 Arm 的 Axion 处理器。为实现隔离并提升性能,我们采用了非统一内存架构(NUMA),并对整个平台进行了全面优化。
• 针对现代的混合专家(MoE)模型,我们把互连(ICI)带宽提升到 19.2 Tb/s。新的 Boardfly 架构将最大网络直径缩小了一半以上,保证整套系统作为一个统一且低延迟的整体运行。
• 消除卡顿:我们的新型片上“集合加速引擎”(CAE)负责处理全局操作,可将片上延迟最多降低 5 倍,从而显著减少卡顿。
用户可以将常用的 AI 提示保存为“Skills”,并在不同网页上直接调用,无需每次重复输入。
Gemini 已经可以让用户对网页提问、总结页面内容或完成各种操作。Skills(技能)则更进一步,让用户把常用的 AI 提示保存为可重复使用的工作流,只需点击一次就能调用。
例如,Google表示,如果用户在浏览食谱网站时常常让 Gemini 提供素食替代方案,现在可以将该提示保存下来,并在其他网页上重复使用。
要使用此功能,需在聊天记录中将 AI 提示保存为“Skill”。后续在 Chrome 的 Gemini 中,只需输入斜杠 (/) 或点击加号 (+) 按钮即可调用该技能。该技能会在当前打开的网页上运行,并同时作用于你选中的其他标签页。
Google表示,这些Skills可以随时进行编辑。同时还推出了一个面向常见任务和工作流程的现成技能库,供你直接使用。
Karpathy 最近在 X 上分享了他用 LLM 来管理个人知识库的方法[Link],这个帖子很快爆火,核心思路是把 LLM 当成知识编译器,而不是单纯的问答工具或代码生成器。
MindOS 就是把 Karpathy 的思路完全产品化,核心理念是人类负责思考、审视和演化想法,AI Agents 负责执行任务、反思并提炼标准操作流程(SOP)
直接将这句话发给 Agent 就可以开始了:
帮我从 https://github.com/GeminiLight/MindOS 安装 MindOS,包含 MCP 和 Skills,使用中文模板。📮投稿 📢频道 💬吹水 🌐网站
AI编程工具Cursor高调发布自研模型Composer 2,宣称性能超越Claude Opus 4.6且价格大幅压低。
却在不到3小时内遭开发者揭穿——其底层基座正是中国月之暗面的开源模型Kimi K2.5,引发马斯克及网友“套壳”群嘲。
Cursor创始人随后致歉承认未标明基座,但强调进行了大量强化学习;月之暗面则回应确认系合规授权合作并表祝贺。
UI 设计从提示词出图的传统模式转变为「Vibe Design」(氛围设计)
📮投稿 📢频道 💬吹水 🌐网站
Opus 系列模型中首次推出了处于测试阶段的 100 万 token 上下文窗口。
Claude Opus 4.6 在编程能力上超过了前一代。Opus 4.6 的增强能力也可用于各种日常工作:做财务分析、开展研究,以及使用和制作文档、电子表格和演示文稿。
在 Cowork 平台上,Claude 可自主处理多项任务,Opus 4.6 能代您把这些能力切实运用到工作中。
在 Claude Code 中,现在可以组建代理团队协同处理任务。通过 API,Claude 可以通过“压缩”技术总结自身上下文,从而执行更长时间的任务而不触及限制。
我们还推出了“自适应思维”,模型能根据上下文线索决定何时及多少使用延展思考能力,并新增了“努力”控制,帮助开发者在智能、速度与成本之间做出更精细的权衡。
Claude Opus 4.6 已在 claude.ai、claude API (每百万tokens $5/$25)以及各大云平台上线。