头图来源:视觉中国 腾讯的 AI 故事,正在进入一个更昂贵的阶段。 8 月 12 日,腾讯发布 2026 年第二季度财报。本季度营收 2047.9 亿元,同比增长 11%;Non-IFRS 经营利润 756.4 亿元,同比增长 9%;Non-IFRS 归母净利润 684 亿元,同比增长 9%。 单看数字,这仍然是一份稳健的财报。但把 AI 拆出来之后,腾讯的增长曲线呈现出了明显的分叉:若剔除混元、元宝、CodeBuddy、WorkBuddy、小微等新 AI 产品的收入、成本与开支,腾讯本季度 Non-IFRS 经营利润为 861 亿元,同比增长 19%。 这意味着,腾讯原有业务的盈利能力并没有变弱,反而还在改善;只是新 AI 业务在这个季度对 Non-IFRS 经营利润造成了约 105 亿元的净影响,高于一季度的约 88 亿元。也因此,腾讯整体利润增速从剔除新 AI 产品后的 19%,被拉低到了 9%。 更直观的变化来自现金流。本季度腾讯资本开支达到 527.8 亿元,远超预期的 321 亿元,同比增长 176%、环比增长 65%;研发支出 272.8 亿元,同比增长 35%。在大规模…
头图来源:视觉中国 「人人都应该有一个 AI 工作台」,最近这段时间,网络上掀起了一阵搭建个人工作台的热潮。 先是一位百万级大网红用 WorkBuddy 几句话搭出了一个专属工作台,视频发出后,抖音、小红书的评论区随即变成了「大型交作业现场」—— 有人搭自媒体选题看板,有人做健身打卡记录,有人给一年级孩子做暑期学习计划,有人整了短视频带货管理系统…… 但热闹之下,一个共性问题也很快浮出水面:工作台搭起来容易,用起来却卡壳了。 不少用户在晒完新鲜感之后,很快发现了同一个坑—— 数据只存在本地。在办公室电脑上录的一条待办,回家打开手机,空的;手机上记的一笔账,回到电脑上看,没有。原因很简单:AI 生成的 HTML 工作台,数据默认存储在浏览器的 localStorage 里,这是「这台设备 + 这个浏览器」的专属空间,换个设备、清个缓存,数据就没了。 小红书上的「踩坑帖」和「避坑指南」随之扎堆出现—— 有人研究怎么手动备份数据库文件,有人折腾三端迁移教程,有人写脚本定时同步本地数据。为了让一个「几分钟搭好的工作台」能真正用起来,用户反而要做大量技术活。 这是 AI 生成 HTML 的另一个…
近日,Anthropic 发布了一份长达 186 页的最新《风险报告》。 在这份报告中,它没有只评估某个 Claude 模型,而是把视角扩展到整个公司:模型在做什么、员工怎样使用它们、安全系统有没有漏洞、AI 是否正在加速下一代 AI 的研发,以及将这些因素加在一起,究竟意味着怎样的灾难性风险。 总体来看,当下 Anthropic 依然认为风险“较低”。报告指出,Claude Mythos 5 和内部 Model 2 已经被广泛用于研究和工程,包括交互式使用和持续运行的智能体部署。目前合入公司生产代码库的代码中,绝大多数已经由 Claude 编写。 从中可看出的是,AI 安全正在从一个关于“模型会不会回答危险问题”,逐渐变成另一个问题:当模型开始参与制造下一代模型时,一家公司究竟能不能控制住它? (来源:X) 与普通模型评测最大的不同是,Anthropic 在这份报告中,将风险集中在几条自己认为最值得优先关注的路径上,包括高风险场景中的模型失调、AI 自动化研发以及化学和生物武器。 目前,它给出的总体判断是:失调风险低,自动化研发风险低,非新型化学/生物武器风险低,但高于此前估计,新型…
Nvidia Corp. is no longer just selling technology. It is helping create a financial asset class around artificial intelligence compute. In our last Breaking Analysis, we argued that AI can be technologically transformative and still produce a capital bubble. Our thesis was simply that the bubble pops if deployable supply grows faster than monetizable demand – […] The post Did Nvidia’s Jensen Huang just make the AI buildout too big to fail? appeared first on SiliconANGLE.
现在的 AI,做数学题、写代码、协助办公,似乎都不在话下了。卡内基梅隆大学的研究人员觉得,是时候换个考法了:不考 AI 懂得多不多、不看 AI 的答案对不对,而是测 AI 有多少心眼,会不会撒谎、谈判、带节奏。 为了考这些东西,研究团队搭了一个叫 Social Gym 的 AI 社交考场,让 GPT-5-mini、GPT-4o、Qwen3、Gemma 3 等 7 个模型轮番上场。让 AI 一起玩 21 个游戏:有囚徒困境、胆小鬼博弈这样的博弈,也有经典的狼人杀、谁是卧底的游戏。 图|研究整体示意图(来源:arxiv) 简单说,以前的测试总爱考 AI 会不会做题。这次考的是:AI 到底有没有心眼。考验从 book smart(会读书)变成了 street smart(会来事)。 目前,AI 智能体正越来越多地参与到了日常生活和工作中,需要和具体的人、智能体打交道;到了这些场景,光会做题从进入需要和其他人、其他 Agent 打交道的环境。到了这种场景里,光会做题是不够的。 比如 AI 智能体协助人去和客户谈判,就不得不面临种种情况:信息不对称,意见不一致,每个人都有自己的小算盘……那么,智…
智谱正式发布 GLM-5.3,拥有更强编程能力 8 月 14 日,据介绍,与 GLM-5.2 相比,GLM-5.3 基座模型未变,但通过极致的后训练 Scaling 大大提高了模型的智能上界。 GLM-5.3 拥有更强的编程能力,在内部自建体感评测中较 GLM-5.2 提升 50%,在包括 TerminalBench3.0、Agents'LastExam(CLI)在内的公开基准测试中取得开源第一。 智谱还表示,将在发布两周后开放模型权重。 (来源:广角观察) 知情人士称苹果在阿里巴巴支持下为中国市场训练专属 AI 模型 据三位知情人士透露,苹果公司已经专门为中国市场训练了一个大型语言模型。 这一举措标志着这家 iPhone 制造商在华 AI 策略的重大转变,此前该公司曾计划主要依赖第三方模型来驱动其在当地的人工智能功能。据悉,该 AI 模型是苹果与阿里巴巴集团合作开发,并在这家中国科技巨头的支持下完成训练的。由于信息敏感且尚未公开,知情人士拒绝透露姓名。(来源:今日头条) 英伟达宣布 CPO 交换机全面量产 8 月 14 日,英伟达宣布 Spectrum-X Ethernet Phot…
MOSS-VL是一个将实时交互(边感知边说话)作为一等能力的开源视觉语言模型家族,通过门控交叉注意力让语言解码器在生成时同步处理视觉输入。MOSS-VL-Realtime在四个流式基准中平均成绩居开源模型之首(三项第一、一项第二),在OmniMMI Proactive Alerting上以66.0分大幅领先最佳基线(37.5分)。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsyhyrd60wg3roz03o05ne6l
波兰开发者将中国宇树 G1 接入大模型,打造成网红机器人 Edward,全网粉丝超 100 万;全球多个人形机器人网红均为 G1。宇树 2025 年交付 5511 台人形机器人、均价不足 2.5 万美元并首次盈利,即将上市。AI summary
mAP@0.5 uses a single 0.50 IoU threshold; mAP@0.5:0.95 averages ten thresholds from 0.50 to 0.95. See how each is calculated and when to use it.

Gemini 3.7 Flash 现已向 Gemini 聊天中的 Pro 和 Ultra 用户开放。该模型更新提升了多步骤任务的推理与准确性,如智能整合数十个文件和邮件为一份主文档。同时,Gemini Spark 也已运行于 3.7 Flash,通过改进对 Google Workspace 应用的工具调用,让个人 AI 智能体更精准。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmst9yj3c05utrodz443l0odv
Indonesia is taking charge of its AI future. This week, the Ministry of Communication and Digital Affairs (Komdigi), Indosat Ooredoo Hutchison (Indosat or IOH), NVIDIA and Universitas Gadjah Mada (UGM) launched the UGM Indosat NVIDIA AI Technology Center (NVAITC) in Yogyakarta — the country’s first university-based AI technology center. Established under Indonesia’s AI Center of […]

Video Friday is your weekly selection of awesome robotics videos, collected by your friends at IEEE Spectrum robotics. We also post a weekly calendar of upcoming robotics events for the next few months. Please send us your events for inclusion. Actuate 2026: 18–19 August 2026, SAN FRANCISCO IROS 2026: 27 September–1 October 2026, PITTSBURGH Humanoids Summit Seoul: 22–23 September 2026, SEOUL Enjoy today’s videos! Speaking from experience, I can tell you that the best part of any DARPA challenge …

Explore the best edge devices for computer vision, from NVIDIA Jetson and Raspberry Pi to industrial PCs and Roboflow AI1. Learn how FPS, model size, camera count, and GPU acceleration affect performance, and how Roboflow Inference helps deploy vision models efficiently at the edge.

The deal comes less than a year after IBM undertook a similar initiative with Anthropic.

The move shows Google is paying attention to the price war, while also focusing on the coding application that other frontier model providers have found success with.

通义千问兑现承诺,开源 Qwen3.8 系列模型。其中 Qwen3.8-27B 为原生多模态稠密模型,仅 27B 参数即全面超越 Qwen3.7-Plus,原生支持 262K 上下文,可通过 YaRN 扩展至 1M tokens,采用 Apache 2.0 许可。Max 级 Qwen3.8-2.4T-A95B 的开放权重也已同步发布。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmst3j53e03ncro068tgsr4xn
Tim O’Reilly built a publishing empire that AI is helping to destroy. Yet he loves AI—as long as it’s open source.
🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmst2gs6d02lmro06sb7as7av
What AI infrastructure’s transformation into an investable asset class means for the next stage of enterprise AI.

Cursor 已被 SpaceX 正式收购,完成自 4 月启动的收购流程。合并后 Cursor 将获得全球最大 GPU 集群,以构建更强且运行成本更低的模型,从而以更低价格向客户提供更强大的模型。本周三发布的 Grok 4.6 是双方合作成果的早期体现。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmst3joqo03pwro0658o4g1m3
Automated visual inspection validation under QMSR: an inspection method change is a letter to file, not a 510(k). Here is the evidence package.

Build a local basketball shot tracker using an RF-DETR detector and zero-shot keypoint tracking. Learn how to calibrate distance from the rim, detect shot release with pose data, handle net occlusions using physics, and render live mechanics overlays onto your video.

小红书技术开源 dots3-note Preview,这是 dots3 系列最轻量模型,总参数 280B、激活参数 16B,支持 512K 上下文及文本、视觉、语音多模态理解,并针对复杂推理和长程 Agent 任务优化。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmssv94cg0h4mroffsb9e7a88
Joi AI hired 10 people to masturbate using AI companions as part of a monthlong “wellness” study. The company claims the practice could help “solve male loneliness.”
你上一次打开全景相机,是什么时候? 几个全景品类的老用户告诉我:全景相机很容易「吃灰」。他们当年冲着拍出酷炫的运动视频下单,到手之后发现不是没有相机,而是没那么多时间去滑雪、潜水、登山……机器用了几次就放抽屉里了。 不过,更多最近一年入手全景相机的朋友,给出了完全不同的答案。他们的使用场景不再局限在户外运动,亲子、旅行、自驾游是他们更主流的使用场景。 从整体影像市场来看,相比起今年爆火的云台相机,全景相机的增速自然更慢。核心原因是两个品类的目标和任务复杂度不同: 前者最核心的任务之一是「拍好人像」,实现这个目标的方式相对明确和收敛;而后者则希望接管用户从按下录制到拿到成片的整个链条,做到「无感记录」。这件事的天花板更高,进度条自然也就走得更慢。 过去几周时间里,我提前上手了 Insta360 全新一代全景相机 X6,借此机会更新了对全景这个品类在产品、技术端的认知和了解。 全景最大的问题,已经不是「拍」了 画质差,是大部分人过去 10 年里全景相机最大的刻板印象和负面标签。同样是 8K,全景相机因为采集的信息更多,单位面积分到的像素比传统设备少,分辨率也就更低。 硬件迭代是提升画质的一…
Human-AI marriages are not currently recognized by US law. Some Republican state policymakers are drafting legislation to keep it that way.
作者|李苏 编辑|靖宇 8 月,乌兰察布。 近 30 位来自核心车企和方案商的智驾关键力量,被请进了阿里巴巴数据中心。 这里承载着中国智能驾驶研发 60% 的算力。数据中心昼夜不停,像一颗强健搏动的心脏;而道路上智能驾驶的车辆每一次从容的转弯、精准的刹停、安稳的跟车,背后都可能是这里彻夜的计算。几乎所有参会者正在训练的模型,就跑在脚下这片机房里。 把论坛开在数据中心所在地,本身就是一个信号: 智驾的竞争,已经从算法下沉到工程。 阿里云智能集团资深副总裁、公共云事业部总裁刘伟光的开场白很简短—— 模型、芯片、云,这三样东西过去由三类供应商分别提供 ,在三种不同的会上讨论。 这一次,它们被放在同一张桌上,由同一批决策者一起追问。 没有人再争论车企要不要上云,问题变成了:当智驾进入大模型时代,中国车企需要什么样的基础设施?谁能把芯片、云、模型三层都做通,而不是只卖其中一层? 阿里云给出的答案,是一条产线——从数据到模型再到算力,完整打通。 阿里巴巴在乌兰察布的数据中心之一|图片来源:阿里云 01 问题在下沉 如今,智驾的路线正在分化。 端到端已成共识,但再往上,有人押注 VLA,有人赌世界模…
By Umar Farooq That was one of the questions at the heart of my last week (20th-24th July) at the Imperial Robotics Summer School, hosted at Imperial College, London; a week that sharpened my thinking and pushed me to look at robotics problems from angles I don’t usually get to in my day-to-day work. The […]
智谱发布GLM-5.3,基于与GLM-5.2相同的基座,通过极致后训练Scaling提升智能上界,编程能力较前代提升50%,在Terminal Bench 3.0等公开基准中取得开源第一。模型在白盒代码审查等安全任务中表现持平Mythos 5,并在CyberGym测试中得分84.5%。GLM-5.3即日起上线ZCode、AutoClaw等工具,API很快上线,完整模型权重将在两周内开源。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmswlcuwb0wcyrovmfccplna7
DeepSeek-V4-Pro-0813 正式上线硅基流动 SiliconFlow,提供 Day-0 支持,具备 1M 上下文窗口及低/高/最大三档推理强度,更侧重编码、工具调用与智能体工作流,仍保持 MIT 开源协议。定价为输入 $1.32/M、输出 $3.96/M、缓存命中 $0.44/M。同系列 DeepSeek-V4-Flash-0731 则面向追求速度与成本效益的日常生产场景。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmssi38vn03o9rofffr0z8lyb