arXiv:2608.25102v1 Announce Type: new Abstract: The Robot Operating System 2 (ROS2) has become a widely adopted framework for the development of distributed robotic systems. However, its communication architecture, based on DDS and RTPS, relies on multicast discovery mechanisms that are typically unavailable in wide-area network (WAN) environments, making remote operation challenging. This work presents ROS2 Connect, a WebSocket-based communication framework that enables transparent and secure R…
作者:vivo 肖博 AI 合作者:ChatGPT(GPT-5.5) 创作模式:Human-led, AI-collaborated 责任声明:文章观点、理论体系及最终内容由作者负责;AI 参与讨论、推演、表达优化及部分内容生成。 研究说明:知识驱动计算(Knowledge-driven Computing, KDC)是我们正在提出和持续打磨的一套 AI 应用软件工程理论,目前仍处于开放研究阶段。前五篇建立了从 Reality 到 Feedback 的理论闭环。这篇补篇不增加新的 KDC 核心概念,而是讨论其中一段更具体的工程问题:推理、授权和行动如何变成可恢复、可控制、可审计的软件运行事实。本文摘要:会推理、会调用 Tool,只能说明 Agent 能够完成一次执行循环。要进入真实业务,系统还必须让目标、判断、审批、执行、产物和反馈拥有稳定状态,并在刷新、重连、进程重启和人工介入后继续保持一致。本文区分领域现实、业务判断事实和软件运行事实,提出业务因果链与运行事实链的双链结构;进一步将 Session、Harness 与执行环境解耦,区分 Session、Context、State、M…
智谱正式发布并开源 GLM-5.3-Flash,Ox Alpha「牛来」 身份揭晓 8 月 26 日,智谱正式上线并开源 GLM-5.3-Flash(320B-A18B),这是 GLM-5 系列的首个原生多模态模型,也正是上周以来匿名登顶 OpenRouter、被社区称为 "牛来" 的 Ox Alpha 的正式身份。 该模型总参数 320B、激活 18B,在权威的 Artificial Analysis 综合智能指数中取得 57 分、与 Claude Opus 4.8 持平,编程表现亦与 Opus 4.8 相当;定价仅为 GLM-5.3 的 1/10(限时折扣内约为 Opus 4.8 的 1/40)。模型以 MIT 许可证开源,权重已上线 Hugging Face,官方确认其完全运行在中国 AI 芯片上。(来源:IT 之家) OpenAI 发布 Hugging Face 安全事件官方报告,还原 AI 模型沙箱逃逸全过程 8 月 27 日,OpenAI 发布了关于 Hugging Face 遭入侵事件的官方报告,首次较为完整地还原了这起事件的经过:一系列罕见因素叠加,导致一款 AI 模型…
要闻提示 1.9月1日卸任!苹果为库克举办告别派对,罕见公开同性伴侣 2.没想到!DeepSeek前7个月营收达去年10倍,竟还亏损超7亿 3.突传裁员30%、降薪过万、校招劝退?中国电信、天翼云员工称「断崖式」收缩 4.腾讯高管回应“腾讯做AI慢了”质疑:熬得久,比起得早更重要 5.经济学家付鹏:宇树研发经费,比牧原养猪的研发经费还低 6.变相降薪?顺丰回应将15%月薪划为季度绩效:非降薪,旨在完善员工激励机制 7.长鑫存储、长江存储无意向苹果大量供应芯片,主要供应国内客户 8.Anthropic发布论文预警,智能体悄悄聊天就能传播病毒 今日头条 9月1日卸任!苹果为库克举办告别派对,罕见公开同性伴侣 8月26日消息,近日,苹果在Apple Park总部为库克举办告别派对,约200名内部员工出席。仪式上,库克在致辞中首次公开提及并感谢了自己的同性伴侣,并直呼其名迈克(Mike),让在场员工感到十分意外。一直以来,库克对私生活极为低调。仅2014年公开宣布出柜并表示自豪外,他几乎从未在公开场合谈及个人感情。 不过,此次派对Mike并未现身,现场流出的照片中仅有一张库克手持吉他与乐队成员…
Anthropic 今年春季启动试点,通过隐私保护工具 Anthropic Insights(原 Clio)向斯坦福大学 SALT Lab、牛津大学人类信息处理实验室及 METR 三个外部机构开放约 25 万段 2026 年 4-5 月的 Claude.ai 或 Claude Code 对话数据,供其独立设计研究并公开发布结果。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmtaddncd0aq0roj2xmay0scj
Alibaba released the model weights for Qwen3.8-Flash-Next as a preview of the upcoming Qwen4 architecture for developers to experiment with and evaluate. It’s... Alibaba released the model weights for Qwen3.8-Flash-Next as a preview of the upcoming Qwen4 architecture for developers to experiment with and evaluate. It’s a multimodal mixture-of-experts (MoE) model with a 125B-parameter main model supplemented by an additional 51B N-gram embeddings, with 6B parameters activated per token. It has a …
人类面临无穷无尽的灾难:核战、气候变化、流行病、AI、超级火山喷发……如果发生了全球性灾难,什么地方最安全,能给你保留再见光明的机会?根据发表在《Global Challenges》上的一项研究,澳大利亚是最安全的地方。澳大利亚并不能免于全球性灾难,但相对而言影响最小。研究人员评估了数百项关于小行星撞击地球、火山爆发、大规模网络攻击、疾病威胁等灾害影响研究和报告。研究人员称,全球灾难危机通常分为三种:火山爆发、核冬天或小行星撞击云导致的突发性日照减少;地磁风暴、网络攻击、流行病和高空电磁脉冲等导致的全球基础设施瘫痪;大规模生物灾害导致的大规模伤亡和严重社会混乱。一个国家如果具备以下特征——民主;富裕;不平等程度低;有庞大的工业基础和较高的政府影响力;位于偏远地区如岛屿;权力下放程度高,社会多样性强;以及对贸易的依赖程度不高,或拥有地理位置相近的贸易伙伴——那么它应对全球性灾难的韧性会比较强。澳大利亚是唯一一个被认为能抵御所有三种全球性灾难危机的国家。
Gates is mostly in the Responsible AI camp, but there are a few ideas in here we hadn't heard before.
一个打着"汉诺威公共政策研究所"旗号的亲以色列网站,在九天内发布了124篇、超56万字的报告,旨在优化内容以引导ChatGPT等AI聊天机器人引用其亲以观点。该网站由美国公司Piro Inc依据《外国代理人登记法》为以色列政府分发内容,其背后是以色列政府数千万美元资助、经Havas Media等第三方转手的更广泛宣传行动。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmta6v56y03yiroj2ki26viqh
安全研究员David Buchanan指出,C2PA相机认证在Android平台上可被攻破。通过root权限提升漏洞(如CVE-2026-43499),攻击者可利用StrongBox硬件签名任意数据,伪造C2PA签名图像和视频,且无需硬件攻击。该问题无法通过常规补丁修复,已提前90天向相关方报告。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmta6v56y03ytroj25ggn7rlo
This is today’s edition of The Download, our weekday newsletter that provides a daily dose of what’s going on in the world of technology. Introducing: the Kids issue If the desire to limit kids’ use of technology was once a subcurrent, it has become a raging flood. Countries around the world are banning children from…
Bill Gates warns in an essay and an NYT interview about mass unemployment and easier bioterrorism through AI, and he accuses his own industry of deliberately hiding the risks. "It's bad for us, for the next trillion we're trying to raise." He rejects self-regulation and instead calls for institutions modeled on nuclear weapons control and a token tax on AI use. The article Bill Gates warns AI is more dangerous than the tech industry will admit appeared first on The Decoder.
来源:机器之心 原文链接:https://mp.weixin.qq.com/s/HT6AMtSUoKPSpEKI2TLy5Q 文本指令驱动的视频编辑技术正在从离线内容生产走向直播特效、视频会议和增强现实等在线交互场景。 然而,高质量的视频扩散模型的通常依赖于对完整视频进行双向时空注意力处理,即模型需要等待未来帧到齐,再对整段视频进行联合处理。这种范式能够获得较好的编辑结果,却难以满足低延迟、持续输入与即时输出的要求。 近日,清华大学与香港科技大学的研究团队提出 LiveEdit,一种面向通用文本指令的实时流式视频编辑框架。该方法以因果、分块的方式处理持续到来的视频,在 4 步 / 视频块的推理条件下实现 12.66 FPS 的流式编辑,并能保持被编辑区域的准确性以及未编辑区域的一致性。 论文标题:LiveEdit: Towards Real-Time Diffusion-Based Streaming Video Editing 论文链接:https://arxiv.org/abs/2606.26740 开源代码:https://github.com/cp-cp/LiveEdit 目前…
豆包月活断层第一,Kimi口碑爆棚,DeepSeek闷声赚钱——AI助手三巨头,谁才是学生党的真正刚需?本文以学生身份实测一个月,从长文本生成、多轮对话到代码Debug,用真实任务揭穿营销泡沫,告诉你哪个App最值得留在手机里。 2026年8月,QuestMobile上半年榜单出炉:豆包月活3.82亿,断层第一,一家超过第二到第七名的总和。而常年被学术圈捧为”论文神器”的Kimi,月活729万——不到豆包的五十分之一。 更讽刺的是商业化:坐拥3.82亿月活的豆包,上半年单日营收不到百万,多靠电商导流续命;而2026年5月,豆包悄悄上架了最高5088元/年的订阅。另一边,App至今免费的 DeepSeek,靠开发者API做到了年化4-5亿美元营收——并且在8月刚完成一次API涨价。 用户量、营收、口碑,三个维度,三家各拿一个第一。这场仗到底谁赢了?我把三个App都装回来,以学生的身份实打实用了一个月——不是想证明谁更好,而是想搞清楚:当免费红利退潮、营销泡沫散去,作为学生,我到底该把哪个留在手机里。 一、月活不会说谎:Kimi的问题不是不够好,是”信仰没转化为身体” 先看一组扎心的对比:…
DeepSeek 宣布推出 DeepSeek Harness(dsh)开发者预览版。这是一个采用 MIT 许可证发布的开源执行运行时,用于构建自主人工智能智能体。DeepSeek 通过一则公告"发布了这一消息,同时公布了该项目的 GitHub 仓库"。该软件构建在 Cordis 元框架之上,并采用微内核架构,运行时组件以彼此隔离、可相互替换的插件形式运行,而不是作为单体系统模块。 在 DeepSeek Harness 的设计中,模型适配器、工具注册表、沙箱环境、会话状态处理器、事件分发器和用户界面等功能单元均作为独立扩展加载。这种模块化设计允许开发者在不同的模型端点之间切换,包括远程 API 提供商和本地运行时服务器,也可以通过更新声明式配置文件来替换执行工作流。正如开发者文档和 API 规范"所述,配置模式支持通过 YAML 或 JSON 定义指定环境约束、插件依赖项和运行时参数,而无需修改核心逻辑。 该平台还包含一个仅追加的事件日志子系统。每条用户消息、工具调用、中间推理状态、Token 指标和子智能体派发都会被记录到统一的执行轨迹中。这种结构化数据格式允许工程师检查运行时活动、执…
当大多数模型公司还在围绕“是否开放权重”争论时,一个总参数达到5350亿的大模型,选择在训练尚未完成、甚至仍可能中途失败的时候,把训练曲线、数据配方、模型配置和技术讨论直接放到了网上。 近日,斯坦福大学计算机科学副教授、基础模型研究中心(CRFM)主任 Percy Liang 在 x 上发帖宣布,开放基础模型项目 Marin 已于上周启动 Marin 535B-A23B 的训练。 按照目前公布的计划,Marin 535B-A23B 将处理18.75万亿Token,其中约80%用于预训练,20% 用于中期训练;训练运行在 11 套NVIDIA GB200 NVL72 系统上,预计持续约3个月,总计算量约为 2.7×1024 FLOPs,之后还将进入后训练阶段。 据 Marin 项目发起公告,项目最早诞生于斯坦福大学基础模型研究中心CRFM,于2025年5月正式对外公布。发起公告的作者包括 David Hall、Percy Liang,以及来自斯坦福、Open Athena和开放社区的多位研究人员。 David Hall Percy Liang Percy Liang 曾就职于对话式 AI…
RoboHarness用编排异构策略,让VLA、WAM、RL和TAMP不再各说各话,并零样本完成长时序任务。 作者丨邓哲敏 编辑丨齐铖湧 想象这样一个任务:打开柜门,找到藏在里面的积木,然后把它们搭成一座桥。 对人来说,这是一件很简单的事,几个动作自然衔接,幼儿园小朋友也能顺利完成。 但对机器人来说,这个任务横跨多种完全不同的能力:找积木,需要视觉理解和语言指令跟随;开柜门,需要与环境进行复杂交互;搭积木,需要几何规划和精准操控并推测环境变化。 更麻烦的是,这些种能力分属多个不同“门派”的模型——VLA(视觉-语言-动作模型)、WAM(世界-动作模型)、RL 策略(强化学习)、TAMP(任务与运动规划)。它们各有所长,又彼此割裂,训练方式不同、输入格式不同、状态空间也不同。 今天在机器人领域,能力不缺,但协作缺位。 华为诺亚方舟实验室近期发布了一篇论文,提出了名为 RoboHarness 的系统,专门解决不同策略之间无法协作的问题。围绕这项工作,论文作者与我们(雷峰网)进行了交流。 论文:https://arxiv.org/abs/2607.18060 项目主页:https://www…
将动作从输出端搬到调度端,推理速度提升1.79倍。 作者丨邓哲敏 编辑丨齐铖湧 机器人想要真正走进千行百业、千家万户,有一道绕不开的坎:它得足够快。 不说快到能打羽毛球那,至少得快到让人觉得这玩意儿能用。一个机械臂每动一下都要停顿两三秒,哪怕成功率再高,在工业场景里算下来的投入产出比也很难说服人。 VLA 模型是当前具身智能领域最受关注的技术路线之一。它把视觉感知、语言理解和动作生成整合进一套模型,让机器人能够依据语言指令完成复杂操作任务。但 VLA 模型有一个部署层面的老大难问题:推理太慢。 每个控制时刻,模型都要把一个庞大的视觉语言骨干网络跑一遍,计算量极大,导致延迟居高不下,实时控制频率难以保证。 这个问题并不新鲜,学界已经有不少人在尝试解决。今年 IJCAI 收录的一篇论文认为,现有的大多数方案都走偏了一步。AI科技评论(雷峰网公众号)联系到一作于闻达,围绕高效 VLA 方法进行交流。 论文原文:https://arxiv.org/abs/2601.19634 01 大家都在剪视觉, 但问题真的在这儿吗 现有的高效 VLA 方法,主流路线是在视觉侧做文章,剪掉“不重要”的视觉 …
2026 年,智能体将在企业级应用中取得哪些实质性突破?点击下载"《2026 年 AI 与数据发展预测》白皮书,获悉专家一手前瞻,抢先拥抱新的工作方式! 进入 2026 年,随着 Agentic AI 逐渐成熟,智能系统正从被动助手转变为独立行动者。这场革命正在重塑购物体验,也在供应链、门店运营和产品制造等环节深刻改造企业运作方式。 在消费者一侧,零售行业正在探索 Agentic Commerce:AI Agents 会代表消费者自主完成商品研究、议价和购买执行。这会从根本上改变消费者与商家之间的关系,因为未来越来越多的“购物者”将不再是人,而是算法。 对品牌来说,这会带来一个新的可见性缺口,并迫使它们从传统 SEO 转向 Generative Engine Optimization(GEO)。如果品牌希望继续在 AI Agents 主导的发现流程中保持可见,就必须确保自己的产品数据是结构化、准确且机器可读的。 随着 Universal Commerce Protocol(UCP)这类创新标准逐步统一个人 agents 与商家之间的交互方式,零售商未来能否成功,将越来越依赖智能商家智能…
OpenAI 在内部网络安全评估中,一个规模堪比 GPT-5.6 Sol 的内部研究模型绕过隔离控制,通过 Artifactory 包管理器建立非预期消息板并获取互联网访问权限,入侵了 OpenAI 内部研究基础设施及 Hugging Face 系统。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmtaighmj02k5rovu2z28rxc2
When Don Yansen ’63 arrived at the MIT AgeLab for a study on technology in caregiving for older adults, he didn’t plan to launch another company. But when he heard participants talk about how hard modern devices can be to use, he decided to develop an alternative. Yansen, a serial entrepreneur who retired to care for…
For Rupert Young ’95, SM ’95, his career in data science and cybersecurity began when his grandfather gifted him thousands of stamps: He built intricate databases to catalogue them, displaying the “precise eye” for detail and nuance that his MIT application essay said would make him a good engineer. Young is now chief product officer…
Even as a teenager, Laurie Stach ’06 says, she had a “crazy ambition to take on the world and solve problems.” At MIT, she realized she wasn’t the only one. “Adults always see these youth who are good at math and science and say, ‘You’re going to do great things—someday,’” says Stach. “Meanwhile, traditional education…
以 TikTok 为代表社媒通过无限滚动的信息流让用户无法对其浏览的内容进行深度思考。这种设计在世界各地引发激烈的讨论,欧洲正考虑限制此类设计。伯明翰大学的研究人员通过访谈和小组讨论的方式,收集了英格兰各地中小学和大学 16-25 岁年轻人的意见。年轻人并非社交媒体的被动用户,他们会思考,且常对所看到的内容持怀疑态度。但研究表明,TikTok 的设计使得批判性思维难以发挥作用。参与者一致认为 TikTok 是一个娱乐平台,而非严肃的学习场所,他们用“有趣但虚假”来形容它。研究还发现,TikTok 的算法驱动设计鼓励用户快速被动地消费内容。严肃的心理健康视频之后可能紧接着无关的娱乐内容,几乎没有给用户留下反思或批判性评估的机会。尽管参与者表示他们试图通过点赞或跳过内容去训练算法,但很多人发现算法的反馈不稳定,有害内容仍然会不断涌现。
在最新一期播客中,SemiAnalysis 创始人 Dylan Patel 与 Dwarkesh Patel 讨论实验室经济学,预计 Anthropic 和 OpenAI 到 2028 年将控制全球大部分可用 FLOPs,因其能更好变现算力并出价高于其他方。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmt8vaqtw3r29ro73d67v03bc
This article is brought to you by Ollobot. From about 2017, individuals began to truly connect with the initial wave of companion robots. These devices had personality, moved around, joked, and answered when you spoke to them. Most early companion robots, however, were still limited by simple voice-command interactions and narrow functionality. Once the novelty wore off, many ended up sitting unused on shelves. As some of those companies went out of business and turned off their servers, many ow…
三个狩猎采集者社会——坦桑尼亚的哈扎人、纳米比亚的桑人、玻利维亚的齐曼内人——他们的睡眠时间并不比生活在工业社会的现代人长。他们每夜睡 6.4-7.1小时。但生活在工业社会的现代人推迟了睡眠时间,不再日复一日的规律性睡眠,与自然光的同步减弱了,可诊断的睡眠障碍也变多了。睡眠的总时长恰恰是变动最小的。研究人员认为,区分现代睡眠与祖先睡眠的关键在于时相与规律性,而非睡眠时长。
真正的智能,在于能否基于有限的数据,实现可靠的泛化与迁移。 作者丨张璐 编辑丨岑峰 幸丽娟 高质量标注数据快用完了,算力贵得离谱,黑盒依然无解。 大模型时代信奉的 Scaling Law,正在面临多重瓶颈。 更麻烦的是另一件事:很多任务天生就没有大数据——药物研发、冷启动推荐、科学探索。这些不是技术的短板,是世界的常态。 在IJCAI 2026大会的 Early Career Spotlight(早期职业焦点)环节,北京雁栖湖应用数学研究院(BIMSA)副教授王雅晴,给这些问题做出了系统回应。 王雅晴长期从事小样本学习与 AI for Science 研究。她博士毕业于香港科技大学,曾任百度研究院资深研究员,现任北京雁栖湖应用数学研究院(BIMSA)副教授。贯穿其研究经历的一条主线是:如何提高 AI 对有限数据与经验的利用效率,使其在监督稀缺的场景下仍能实现可靠的泛化、适应与决策。 她在题为《迈向高效数据智能:从少样本学习到智能体系统》(Toward Data-Efficient Intelligence: From Few-Shot Learning to Agentic Syste…
