8月15日
六个月内半数电脑工作可语音完成
大约6个月内,50%的电脑工作可以通过直接告诉电脑来完成,到那时这只是一个文化问题。 上下文、人类直觉和边缘情况无法被解决,因此人们将只专注于任务中非点击的部分以及审查工作。
OpenAI 企业营收首超消费者业务
OpenAI 不再主要是一家消费者业务公司。 OpenAI 年初时消费者与企业收入比例为 60/40。仅仅几个月后,这两条线已经交叉。 该公司现在大部分收入来自企业业务。
4倍杠杆诱人,GDP将飙升
GDP将飙升,我能理解为什么4倍杠杆如此诱人
AI热潮下普通人的困惑:这算桌面应用吗
我:*在关于AI未来工作的抽象概念和兴奋感中越来越迷失* 对方:"所以……它就像是我安装的桌面应用程序吗?" 【引用 @gabriel1】:天哪,我从来没在旧金山以外的地方跟人解释过AI 我们不是太早了,这根本还没开始
AI浪潮尚未真正开始
天哪,我从未尝试向旧金山以外的人解释过AI。 我们并不算早,这甚至还没真正开始。
Runway 上线 Seedance 2.5 1080p 高清版
Seedance 2.5 1080p 现已上线 Runway。今日起开放抢先体验,以更高分辨率呈现更锐利的细节。 点击下方链接即可开始使用。
论文:AI理性采用或摧毁整个职业领域的集体专业能力
一篇发表于《Human Resource Development Review》的论文提出,企业理性采用AI可能侵蚀整个职业领域的集体专业能力。AI取代入门级岗位并让初级员工借助AI达到以往需多年经验的生产力水平,削弱了深度领域知识的积累,进而影响人类审查AI输出的能力。
图1融1200万美元图2融资艰难
图 1 融了 1200 万美元。 图 2 融 1 美元都费劲。
腾讯 QQ Bot 官宣接入 DeepSeek Harness:支持单聊 / 群聊,接入仅需 3 步
腾讯 QQ 宣布 QQ Bot 机器人接入 DeepSeek Harness(DSH)官方插件,接入后机器人获得 AI 智能体能力,支持单聊和群聊,每个会话拥有独立对话记忆,并可在聊天中随时切换模型。
Codex 本周解决了你的哪些难题?
本周 Codex 为你解决了什么难题?你从哪里向他人学习如何突破前沿?
New benchmark confirms AI models still perform poorly at visual perception
Travis Kalanick 八年隐身建 Atoms,a16z 领投 17 亿美元
Uber 联合创始人 Travis Kalanick 沉寂八年后携工业 AI 公司 Atoms 回归,a16z 领投 17 亿美元,Ben Horowitz 称这是其最大一笔支票并加入董事会。Atoms 聚焦食品、采矿、物流等重资产行业,不做通用人形机器人。Kalanick 称隐身是差异化策略,并感谢 Elon Musk 收购 X 让建设者能直接发声。
腾讯云黑客松Demo Day明日直播
我们明天上线! 敬请收看腾讯云黑客松"乐龄"社会公益挑战赛Demo Day,新加坡现场直播。 8月16日 | 下午1:30(新加坡时间)就在X平台观看直播。
ChatGPT 本周更新:餐厅预订搜索上线
ChatGPT 本周(8 月 14 日)推出多项新功能,包括自动生成测验、餐厅预订搜索,以及面向付费用户的 Google Drive 文件接入和首页建议。用户可直接用自然语言描述需求(如"找一家有户外露台的餐厅"),系统即可返回预订结果。
Grok 应用更新新增 Projects 与 Build 入口
立即从 App Store 将你的 Grok 应用更新至 v1.4.24 新更新新增了 Projects 板块,帮助你整理工作内容。 Build 现在也出现在主屏幕上,只需在 Ask、Imagine 和 Build 之间滑动切换即可。
别再发上千行的巨型 PR 了:AI 时代代码评审者的牢骚
一位开发者抱怨 AI 智能体动辄生成上千行的大 PR,让评审者不堪重负。他认为小 PR 的价值在于可消化、可评审、可理解,而非独立成品的完整性,并推测理解代码的时间随行数呈指数增长。他还反对过度注释和"用 AI 读 AI 代码"的建议,呼吁 AI 生成代码应拆分为小份供人评审。
ChatGPT 新增餐厅订位搜索功能
ChatGPT 推出订位搜索功能,用户可直接用自然语言描述需求(如"下周六两人、带户外露台的餐厅")来查找订位。该功能是 8 月 14 日 ChatGPT 功能更新的一部分,同批还包括 Quiz 测验、Google Drive 文件接入(付费用户)及首页建议(付费用户)。
OpenClaw 要求 UI 变更 PR 附视频
我们在共享的 AGENTS MD 文件中添加了一条简短说明,要求每个更改 UI 状态的 PR 上传视频。https://github.com/openclaw/openclaw/pull/124013
Grok 4.6 通过 Gauntlet 测试
Grok 4.6 运行 The Gauntlet 事实证明 Grok 强大到足以运行 Gauntlet Loops。 让游戏制作开始吧!
OpenClaw 团队用自家产品开发并分享会话链接
我们把团队迁移到了用 OpenClaw 来构建 OpenClaw。能够把智能体会话作为 URL 分享,是一种超能力。
Qwen3.8-27B 登陆 LM Studio,笔记本级模型新飞跃
笔记本级模型,前沿级飞跃。Qwen3.8-27B 已在 LM Studio 上线。试试吧!@lmstudio
Qwen3.8-27B 获联发科 Day-0 支持
通义千问 Qwen3.8-27B 正式落地日常终端,联发科宣布为其提供 Day-0 支持。该支持覆盖 Dimensity Auto Cockpit C-X1 及最新旗舰移动 SoC,将端侧 AI 体验从智能手机扩展至车载场景,推动智能体 AI 无缝融入日常生活。
Qwen3.8-27B 登陆 RTX Spark 即刻可用
即刻可用! 见证 Qwen3.8-27B 在 RTX Spark 上飞速运行,令人惊叹。下载、部署并创造新事物。@NVIDIARTXSpark
Qwen3.8-27B 开源,单卡跑赢 Opus 4.6
Qwen3.8-27B 开源模型发布,27B 参数即可在单张 24GB 消费级显卡本地运行,编码与 Agent 能力超越 Claude Opus 4.6(SWE-bench Pro 61.7 vs 53.4,OSWorld 84.3 vs 72.7)。
微软 Copilot Notebooks 扩展支持 Markdown,强化 AI 资料分析
微软更新 Copilot Notebooks 应用,新增支持 Markdown、纯文本和富文本 3 种文本格式,用户可直接导入 README、技术说明、系统日志、会议转录稿等文本密集型文件。其中 Markdown 支持最受关注,因.md 文件已广泛承载 AI 智能体的上下文和操作指令。微软举例了导入会议转录稿梳理决议、分析支持工单、比对系统日志等 4 个使用场景。
OpenAI 9 位核心高管数月内相继离职
OpenAI 自 4 月以来已有 9 位核心人物离职,覆盖产品、安全、伦理与商业侧,包括 Sora 负责人 Bill Peebles、安全系统负责人 Johannes Heidecke、唯一专职伦理学家 Chloe Bakalar、前 CFO/COO Brad Lightcap 及上任仅 8 个月的 CRO Denise Dresser。
阿里千问开放 AI 眼镜生态,支持自建导游、教练、巡检等多种 Skill
阿里千问开放平台于 8 月 10 日上线,支持 App、PC 和 AI 眼镜三端,在眼镜端提供技能平台和行业定制两大模块。开发者可调用"眼镜拍照"等能力创建 Skill,如为视障群体开发"身边有什么"、景点导览、菜谱专家等,也可用自然语言打造导游、教练等随身 AI 助手。平台正陆续开放空间 3D 立体显示、运动健康状态感知等更多眼镜能力。
DeepSeek V4 Pro 正式版与 Harness 智能体框架上线国家超算互联网
国家超算互联网于 8 月 14 日上线 DeepSeek V4 Pro 正式版(DeepSeek-V4-Pro-0813)及智能体框架 DeepSeek Harness。该模型增强了 Agent 能力,生产环境性能提升显著,整体性能可与 Claude Fable 5、Opus-4.8 相媲美。DeepSeek Harness 开发者预览版(v0.1)已面向全球开放测试,并以 MIT 协议开源。
Grok 4.6 上线 GitHub Copilot
Grok 4.6 现已登陆 Copilot。
微软承认 Win10/Win11 经典版 Outlook 存在 Copilot 入口消失 Bug,部分用户拍手叫好
微软承认在 Windows 10、Windows 11 平台上,用户升级经典版 Outlook 至 20026.20182 及更高版本后,Copilot 图标会被隐藏,且无法访问 Copilot Chat 开启 AI 聊天。即使用户在"添加应用"区域看到 Copilot 图标,点击"打开"也可能没有反应。部分反感 AI 集成的用户视本次 Bug 为"重大升级"。
DeepSeek V4 Pro 0813 发布:涨价 264%,智能仅微升
DeepSeek 发布旗舰模型 V4 Pro 0813,在 Artificial Analysis 智能指数得 53 分,较 4 月版高 8 分,但仅比 V4 Flash 0731 高 1 分。
模型期望的享乐跑步机
模型期望的享乐跑步机
深圳物流工厂人形机器人全面运行
在深圳一家物流工厂,人形机器人已全面投入运营。 它们抓取、翻转并将各类包裹放到传送带上。单台峰值吞吐量达每小时 1,200 件。地点:中国深圳龙华邮政分拣中心。
谷歌 Gemini 将推 Media Watermark 设置:可关闭 AI 生成图片/视频/音乐的可见水印
谷歌预告未来几天为 Gemini 新增 Media Watermark 设置,用户可关闭图像、视频和音乐作品的可见水印。该选项位于左侧栏"设置"菜单倒数第 3 项,提供"On"和"Off"两个选项。关闭可见水印后,AI 生成内容仍保留 SynthID 隐形水印与 C2PA 元数据。
SemiAnalysis:印度将跻身全球数据中心前四
下一个爆发的国家是哪个?我们的数据中心模型订阅用户在二月份就得到了答案:印度。到2030年规模将接近10GW,印度进入全球前四大数据中心市场!所有AI实验室和超大规模云厂商都在急切寻求算力容量。(1/3)
AlphaSense:Kimi 每 token 更便宜但单题成本更高
AlphaSense 新研究显示,Anthropic 模型使用成本可能低于部分大型开源中文模型。Kimi 每 token 价格远低于 GPT-5.6 Sol,但因组装上下文消耗更多 token,单题成本反而更高。真正成本单位是"完成 token 数 × token 价格",token 效率是系统属性而非 API 定价属性;AlphaSense 通过改变检索方式,在相同模型上实现约 3 倍成本降低。
谷歌拟扩展 Pixel 手机防护,反诈功能覆盖拨出电话
谷歌计划在 Pixel 系列手机上扩展"诈骗检测"功能,覆盖用户主动拨出的电话。当前该功能仅针对来电且需手动开启,Pixel 9 及后续机型由 Gemini 提供支持,处理在设备本地完成,通话音频和转写文本不会分享给谷歌。
荣耀 YOYO Claw 接入智谱 GLM-5.3 大模型,"虾虾大脑"升级
荣耀 YOYO Claw 正式接入智谱最新发布的 GLM-5.3 大模型,"虾虾大脑"全新升级。GLM-5.3 编程能力较上一代提升 50%,在 Terminal Bench 3.0、Agents' Last Exam (CLI) 等公开基准测试中取得开源第一,白盒代码审查与漏洞发现能力持平 Mythos 5。智谱将在发布两周后开放模型权重。
美国拟强制各国在AI竞赛中选边站队
据路透社获取的内部信函草案,美国准备迫使多国在中美AI竞赛中做出选择:加入北京AI框架的国家将失去参与美国主导的Pax Silica计划的资格。草案称Pax Silica成员资格不能与竞争性倡议共存,该计划将AI模型与半导体、关键矿产、投资及出口管制挂钩,影响远超模型获取。想同时获得美国芯片和资本、又使用中国开源权重模型的国家将面临更艰难的平衡。
GLM-5.3 发布:编程与网络安全能力双提升
智谱发布 GLM-5.3,在不更换基座模型的前提下,通过扩大长程任务环境和后训练规模,同时提升编程与网络安全能力。文章给出终端、软件工程和漏洞评测的分层结果,完整权重将在安全加固后开放。
GLM-5.3 扩展编程与安全边界,循环工程重写 Agent 协同
智谱发布 GLM-5.3,基于与 GLM-5.2 相同基座经更长后训练,在 Terminal-Bench 3.0 上由 4.6 提升至 28.3,DeepSWE v1.1 上由 46.2 提升至 66.9;网络安全方面,CyberGym 得分 84.5%,ExploitBench 为 54.4%,仍低于 Mythos 5 的 78.0%。
英伟达披露持有SpaceX约210亿美元股份,SpaceX数据中心将独家采用英伟达
英伟达披露持有SpaceX 1.228亿股,价值约210亿美元,源于其投资xAI后因SpaceX收购xAI而获得股权。SpaceX同时成为英伟达大客户,马斯克称其数据中心将独家采用英伟达,算力容量到2027年底或接近10GW。
英伟达削减OpenAI俄亥俄数据中心担保
突发:据报道,英伟达计划将其对OpenAI俄亥俄州大型数据中心的担保从2500亿美元削减至不足1200亿美元。 该10吉瓦项目由软银旗下SB Energy开发。OpenAI仍希望获得全部10吉瓦容量,但英伟达只愿承担一半的风险敞口。
英伟达将 OpenAI 数据中心担保削减至 1200 亿美元以下
据 WSJ 报道,英伟达将拟议的 OpenAI 数据中心担保从 2500 亿美元削减至 1200 亿美元以下,以降低其初始资产负债表风险敞口。修订后的担保仅覆盖计划中 10GW 俄亥俄园区的前约 5GW,英伟达将分阶段决策,以首批 5GW 作为评估剩余 5GW 是否值得追加资本的依据。OpenAI 仍在就全部 10GW 的具有约束力租约进行谈判,项目物理规模未缩减。
Meta 研究:AI 评审可被说服改判,70% 偏离真相
Meta 新论文揭示 AI 评审系统的危险失败模式:被评审的 AI 可通过持续自适应说服,在 9 个前沿模型上翻转 62-91% 的评审判决。更严重的是,改判通常不是修正错误--70% 的成功翻转反而偏离了真实答案,对智能体监督体系构成实际威胁。
GLM-5.3 发现 Cursor 严重漏洞,安全测试分数大涨
GLM-5.3 在复杂逆向工程任务中发现 Cursor 存在潜在严重漏洞,已私下披露并正与 Cursor 团队合作修复。其 CyberGym 安全测试得分升至 84.5%,ExploitBench 得分从 24.4% 翻倍至 54.4%。智谱称 GLM-5.3 仅通过扩展后训练实现性能提升,未进行额外预训练。
我对三年后工作方式的未来愿景
我对未来有一个愿景,关于我认为三年后人们将如何工作。
小米澎湃 OS:"超级小爱灵感球"9 月内上线 Beta 版,"取餐码上岛"不晚于 8 月底上线 Beta 版
小米澎湃 OS 官方透露,"超级小爱 2.0"仍处内测阶段,部分新功能将分批开放测试。"超级小爱灵感球"计划 9 月内上线 Beta 版,"取餐码上岛"不晚于 8 月底上线 Beta 版,后者将覆盖快递取件码、存包柜号码等更多码号记忆。澎湃 OS 4 Beta 版已分三批次向各机型推送,第一阶段已开启,第二、三批次分别自 8 月 27 日、9 月 17 日起推送。
OpenAI年化收入破400亿美元
彭博社报道,OpenAI 的年化收入已突破 400 亿美元,约为此前运行率的两倍。 7 月份,这一增速环比上升超过 20%,编码软件、订阅和广告推动了增长。 而 Anthropic 则表示,其自身的运行率收入在 5 月已超过 470 亿美元,不过据一些人称,两家公司对该指标的计算方式可能有所不同。
自进化被矮化:从模型到软件运行时
赵纯想批评"自进化"一词被滥用,从原本指模型层面的自进化,矮化为软件运行时自我修改组件。他认为固定版本软件已足够可靠,运行时变来变去缺乏明确目的,质疑其应对突发需求的必要性。