宇树人形机器人实现全自主搏击,世界模型路线首获验证
9月7日晚,宇树科技发布视频展示其世界-动作大模型 UnifoLM-X2-1.0 驱动人形机器人完成“出拳-格挡-躲闪-连续攻防”全程脱遥控、无脚本的全自主搏击。
这是全球首次在人形机器人上实现动态对抗场景下的实时规划与决策执行,突破了瞬时交互瓶颈。此前宇树虽以运动控制见长,但一直被质疑“小脑强、大脑弱”,此次发布是其 IPO 募资超 20 亿元投入具身大模型后的首个公开答卷,验证了“世界模型+动作大模型”技术路线在复杂动态环境中的可行性。
然而,演示视频虽惊艳,实际泛化能力仍待检验,目前尚处早期阶段,距离真实应用场景仍有距离。
全自主搏击涉及安全伦理边界,若失控可能造成人身伤害,监管框架亟待建立。宇树此举为具身智能树立里程碑,但“ChatGPT 时刻”不会因一次演示就到来。后续 1-2 个季度的产品迭代、第三方测试及商业化进展才是关键观测点。
毕竟,机器人不是表演道具,唯有在不可预测的真实世界中稳定运行,才算真正跨过智能门槛。行业期待突破,但也需警惕过度解读单次成功。
官网地址:宇树科技官网

微信开源WeMM-Embedding,多模态检索日调用破10亿次
微信 AI 团队 9 月 4 日宣布开源通用多模态嵌入模型 WeMM-Embedding,提供 2B、4B、9B 三个版本,支持文本、图像、视频及交错输入的统一语义表示。
据内部员工透露,该模型已在朋友圈搜索、视频号推荐、公众号推荐及微信电商等核心场景大规模落地,日均调用量达 10 亿次,并在国际权威榜单 MMEB-v2 中位列第一,超越所有开源与闭源模型。代码、论文及权重已同步开放于 GitHub、arXiv 和 Hugging Face。
这一举措不仅彰显微信在多模态理解上的工程实力,也为社区提供了高质量基础组件。但需理性看待:榜单高分不等于业务普适,微信内部数据分布可能与外部差异显著;10 亿次调用反映生态绑定深度,而非模型通用性优势。
此外,开源版本是否包含全部优化细节?商用许可是否限制竞品使用?这些都将影响社区采纳意愿。对开发者而言,WeMM-Embedding 是宝贵资源,但直接套用未必奏效,仍需结合自身数据微调。微信选择此时开源,既是对技术自信的展示,也可能意在巩固其在多模态基础设施层的话语权。
不过,真正的价值不在排名本身,而在能否推动整个行业多模态检索能力的实质性提升。若仅服务于自家生态闭环,则开源意义有限;若能激发外部创新,则善莫大焉。
详情查看: https://www.aitop100.cn/infomation/details/34636.html

DeepSeek急招150名工程师,规模膨胀倒逼后端重写
DeepSeek Harness 团队负责人崔添翼近日公开招募约 150 名工程师,重点面向服务端开发与 Agent 弹性计算两类岗位,称这是“前所未有的大规模招聘”。
与此前覆盖 7 大类岗位的扩招不同,此次高度聚焦后端系统升级,主因是数据量、训练任务、用户请求等急剧增长导致原有架构难以为继,“量变引发复杂度剧增”迫使系统重写。尽管 DeepSeek 以“小团队高密度”著称,但现实压力使其不得不转向长期主义投入。
值得注意的是,公司近期动作密集:完成 500 亿元融资后接连更新 V4 系列模型、大幅上调 API 价格(最高涨 11 倍),并传闻将在乌兰察布部署 16 万颗昇腾 950DT 芯片。资本层面,第二轮 500 亿元融资、5000 亿元估值及 5 亿美元 ARR 的消息也在流传。
然而,Quest Mobile 显示其月活 1.29 亿居国内第三,Artificial Analysis 智能指数仅排第 15 位,落后于智谱与 Kimi。扩张带来算力与人才红利,但也加剧运营负担。若后端重构滞后,可能拖累模型迭代与用户体验。
另外,高薪抢人能不能留住核心骨干?国产芯片集群稳定性如何保障?都是隐忧。DeepSeek 正从“精锐小队”迈向“工业化军团”,转型阵痛不可避免。市场期待其重回榜首,但规模不等于竞争力,唯有在效率与质量间找到新平衡,才能避免陷入“大而不强”陷阱。
详情查看: https://www.aitop100.cn/infomation/details/34635.html

微信支付智能眼镜SDK上线,Rokid首发适配小额扫码
微信支付近日正式上线智能眼镜 SDK,将“扫一扫”支付能力封装为标准接口,Rokid 乐奇 AI 眼镜成为首款适配产品。用户需在厂商 App 开通并验证密码后绑定微信账号,日常付款只需说“微信扫一扫”、对准二维码、滑动镜腿确认即可完成,全程无需手机。
当前为 Beta 阶段,仅支持面对面收款码、个人经营码及聚合码,聚焦便利店、菜市场等高频小额场景,每日限额 200 元;若设备支持虹膜或指纹识别可提额。安全机制要求眼镜必须连接手机微信,且仅在用户主动确认后扣款。
此举并非创造新支付方式,而是将现有能力延伸至穿戴设备,降低操作门槛。但现实挑战不少:200 元限额难以覆盖多数消费;依赖手机连接削弱便携优势;语音唤起在嘈杂环境易失效;商户端无需改造虽利推广,但也意味着无法获取交易反馈优化体验。
另外,隐私顾虑犹存——视线即支付,误扫风险如何防范?目前仅 Rokid 接入,生态丰富度不足,用户选择有限。微信支付此举更像试水而非颠覆,旨在抢占穿戴支付入口。若后续能提升额度、增强离线能力、拓展更多硬件伙伴,或逐步培育习惯;否则易沦为小众功能。毕竟,支付的核心是便捷与安全并重,眼镜支付若想普及,还需跨越体验与信任双重鸿沟。

可灵AI亮相多伦多电影节,探索AI影视创作落地路径
可灵 AI 宣布将于 9 月 10 日至 16 日参加 2026 多伦多国际电影节市场(TIFF Market),通过产业论坛、行业酒会及专属展位(A20)与全球影视创作者探讨 AI 如何深入电影制作现实前沿。论坛主题为“创作新范式:可灵 AI 驱动连贯、可控的电影级 AI 视频创作”,直面当前 AI 视频生成普遍存在的叙事断裂、风格漂移等痛点。此举标志国产 AI 视频模型首次以专业身份进入国际顶级影视交易平台,试图从“技术展示”转向“产业对话”。
但需清醒认识:参展不等于被接纳,好莱坞对 AI 态度仍谨慎,版权、原创性及工会阻力未解;“连贯可控”承诺能否兑现,需看现场 demo 与合作案例。
另外,可灵虽在国内短剧领域有应用,但在长片级制作中尚无标杆作品背书。本次亮相更多是建立联系、收集反馈,而非立即签约大单。对行业而言,AI 进入电影节是积极信号,但真正融入创作流程还需解决工作流整合、成本效益及艺术家信任等问题。
可灵选择 TIFF 而非纯技术展会,显示其志在产业而非炫技,方向正确。但成败不在展位大小,而在能否拿出令导演、制片人信服的解决方案。若仅停留在概念交流,难改“AI 玩具”刻板印象;唯有产出可复用、可信赖的创作工具,才能赢得尊重。
电影是人的艺术,AI 只是笔刷,笔刷再好,也代替不了握笔的手。
工具地址:可灵AI官网

2026外滩大会发布“AI科技人文十问”,聚焦普通人真实困惑
9 月 8 日,2026 外滩大会发布“AI 科技人文十问”,问题全部来自白领、教师、家长、医生、老人等普通人的真实困惑,如“AI 让效率更高为何我们更累?”“好用的 AI 都要花钱,免费的是否构成新起跑线?”“AI 写的歌让我感动,这份情感会贬值吗?”等。
这是大会连续第四年发起“十问”,从 2023 年追问 AI 去向,到 2025 年由 AI 反问人类,今年重新回归人的处境。大会将以这十个问题贯穿论坛、展览、艺术节等活动,邀请经济学家、作家、心理学家、哲学家及技术专家共同探讨 AI 时代的工作、教育、情感与信任。展区还将呈现毫米波雷达护老、AI 村医辅诊、外骨骼助行等普惠应用。
此举反映 AI 议题正从宏大叙事下沉至个体生活,技术讨论开始承载人文温度。但也要看到,“十问”本身不提供答案,更多是搭建对话场域。普通人的焦虑不会因一场会议消解,关键在于后续是否有政策、产品或社会机制回应这些关切。
例如,AI 加剧疲劳感,是否源于企业将其作为压榨工具而非赋能手段?付费墙问题,能否通过公共 AI 服务缓解?若讨论止步于精英圈层,未转化为可触达的改变,则“人文”易成装饰。
外滩大会的价值,在于持续记录时代情绪刻度,并推动技术与社会的良性互动。但真正的进步,不在提问多深刻,而在行动多具体。

字节或10月推实时空间视频模型,张一鸣亲自督导VR生态飞轮
据彭博社 9 月 7 日报道,字节跳动正开发一款实时空间视频生成 AI 模型,最快 10 月发布,创始人张一鸣亲自协调资源推进。该模型基于 Seedance 构建,可为直播、短剧、游戏生成交互式三维虚拟世界,类似谷歌 Genie,能将用户置于沉浸环境中,并响应 Pico 头显的语音或动作指令。关键设计是将高算力生成任务转移至云端,降低终端硬件门槛,使低成本 VR 设备也能获得高质量体验。张一鸣视其为串联 AI 模型、云算力、内容平台与 Pico 硬件的“生态飞轮”。
若落地,VR 竞争重心或从硬件参数转向 AI 内容与基础设施。但风险同样显著:实时生成对延迟极其敏感,云端渲染能否保证流畅交互?Seedance 在电影级视频中表现尚可,但空间一致性、物理合理性在 3D 场景中更难保障;Pico 市场份额有限,缺乏足够用户反馈可能拖慢迭代。
而且,苹果 Vision Pro 已确立高端标杆,字节走平民路线需极致性价比支撑。张一鸣亲自督战显示战略优先级高,但技术成熟度与市场需求是否匹配仍是未知数。
若 10 月如期发布且体验达标,或激活 VR 内容供给瓶颈;若延期或效果平庸,则可能错失窗口期。
VR 行业多次经历“希望-失望”循环,用户耐心有限。字节的野心值得肯定,但唯有让普通人真正“愿意戴、喜欢用”,才算打破魔咒。否则,再强的模型也只是又一个未兑现的承诺。









