谷歌AI修图神奇Pics登陆Docs和Slides,文档里点图片就能直接改
谷歌近日正式推出AI图像编辑工具Pics,用户不仅可通过pics.new网页版使用,还能在Google Docs和Slides中直接点击现有图片进入编辑界面,无需跳转或重新上传素材。这一设计明显针对办公场景痛点,让图文协作更流畅。
Pics不强制从空白画布开始,支持导入本地文件、Google Drive及Photos中的图片继续修改。其核心能力包括精确对象分割——可单独调整图中某一物体的位置、大小或样式而不破坏背景;还能识别并编辑图片内文字,甚至翻译后保留原字体排版。此外,批量处理、实时协作以及2K/4K增强功能也已集成。
该工具由Nano Banana图像生成模型驱动,早在今年5月I/O大会就已亮相,当时主要用于海报、邀请函等轻量设计。如今嵌入办公套件,意味着AI修图正从独立工具转向生产力流程的一部分。目前个人用户需订阅AI Pro/Ultra或教育版,企业用户则通过Workspace相应套餐逐步开放。
未来几周还将支持从Drive直接拖放文件至Pics,进一步简化操作路径。这种“就地编辑”模式若体验稳定,或将成为在线文档标配功能,但能否真正替代专业设计软件,还需观察复杂任务下的表现。
详情查看: https://www.aitop100.cn/infomation/details/34601.html

网信办公布AI乱象整治进展,豆包千问等平台强化源头审核
中央网信办近日披露“清朗·整治AI应用乱象”专项行动第二阶段成果:累计清理违规信息561万条,处置账号4.9万个、应用2400余个。重点打击AI换脸、魔改名著、虚假灾害视频及针对未成年人的有害内容,其中“数字泔水”式猎奇改编被点名批评。
各地采取差异化措施:北京升级多模态识别模型,上海推AI防骗知识包,浙江实施“一企一策”合规指导,广东则对重点平台点对点督促整改。抖音、快手、B站等平台同步优化人脸声纹库与实时检测系统,发布46期治理公告。在源头端,豆包、元宝、千问、文心一言等大模型加强语料审核,全面落实生成内容标识;华为、小米等应用商店也收紧上架标准,拦截违规App。
通报案例显示,部分账号用AI伪造救援现场误导公众,或以数字人带货欺骗老年人;更有甚者制作儿童“邪典”视频传播软色情。这些行为已触发警告、罚款乃至关停处罚。监管部门强调将常态化防范技术滥用。
此次行动表明,AI治理正从被动响应转向主动预防,平台责任边界日益清晰。不过,如何在遏制滥用的同时避免误伤正常创作,仍是后续执行中的平衡难题。

腾讯WorkBuddy开放Agent平台,首批接入百家硬件与应用伙伴
9月2日,腾讯WorkBuddy正式上线开放平台open.WorkBuddy.cn,成为国内首个同时打通智能硬件、行业应用与开发者三层生态的AI Agent基础设施。首批引入Plaud、Rokid、影石、科大讯飞等9家硬件厂商,以及覆盖金融、法律、医疗等20多个领域的30余个行业应用。
腾讯云副总裁刘毅在现场表示,WorkBuddy的目标不是做更强的单点工具,而是打造能承载各类Agent能力的操作系统级平台。这意味着第三方开发者可调用底层Agent能力,快速构建垂直场景解决方案,而硬件厂商也能将AI代理深度集成到设备中,而非仅作为附加功能。
此举标志着AI Agent竞争从模型能力比拼转向生态连接力较量。过去Agent落地难,往往因缺乏标准化接口与跨端协同机制。WorkBuddy试图通过统一协议解决这一问题,但其开放性是否足够吸引中小开发者,仍需验证。尤其在与钉钉、飞书等已有生态的竞争中,如何形成差异化优势是关键。
目前平台刚起步,实际调用效率、文档完善度及商业化分成模式尚未完全明朗,行业新标准的建立尚待时间检验。
工具地址:腾讯WorkBuddy官网

努比亚NaviX Ultra 9月发售,号称全球首款AI智能体手机
努比亚总裁倪飞确认,新一代豆包手机将于9月正式发售,命名为NaviX Ultra,定位为全球首款AI智能体旗舰。与传统“带AI功能的手机”不同,该机将大模型智能体嵌入操作系统底层,使其具备类似真人的屏幕理解与操作能力。
例如用户只需说“帮我订明天去上海最便宜的机票”,AI即可自动打开订票App,完成搜索、比价、填表直至付款前确认的全流程,全程无需手动干预。所有记忆与运算均在本地完成,数据不上云,以保障隐私安全。这种架构跳出了AI作为应用的旧范式,尝试让智能体成为系统原生组件。
不过,“AI原生手机”概念虽新,实际体验仍存挑战:复杂App的UI变动可能导致操作失败,跨应用任务链的稳定性有待验证,且本地算力对长任务的支持能力有限。此外,用户对AI自主操作的信任度也需要时间培养。
尽管入网许可已获,但从概念到量产的“最后一公里”是否真正走通,还要看上市后的真实反馈。若体验扎实,或为手机交互开辟新路径;若流于演示,则可能重蹈早期AI手机噱头大于实用的覆辙。

World Labs发布多模态世界模型Atlas,支持像素级镜头控制
李飞飞创办的World Labs近日推出全球首个多模态世界模型Atlas,核心突破在于实现像素级精确相机控制,可在三维空间中重建场景并生成电影级“子弹时间”效果。该模型从头预训练,接受包括相机参数在内的多模态输入,输出与原始几何严格对齐的图像或视频帧。
Atlas不仅能从单张或多张图片生成最长1分钟的1440p视频,还可输出显式3D模型,重建精度超越多数开源方案。它还能根据指定视角自动补全未见区域,支持文本生成图像、360度全景及时空模拟,适用于影视制作、机器人仿真等场景。目前仅向部分合作伙伴开放抢先体验,后续将逐步扩大访问范围。
这项技术的关键价值在于将“可控性”带回生成式视觉——不再是随机出图,而是精准响应导演或工程师的镜头指令。然而,高保真3D生成对算力要求极高,普通用户短期内难以本地部署。
还有就是,模型对输入质量敏感,低质素材可能导致重建偏差。尽管前景广阔,但距离大众化应用仍有距离,现阶段更多服务于专业创作与工业仿真领域。
详情查看: https://www.aitop100.cn/infomation/details/34602.html
Perplexity上线混合计算功能,敏感数据可交由本地模型处理
Perplexity近日在Mac应用中推出Hybrid Compute功能,允许用户将任务拆分给云端前沿模型与本地大模型共同处理。系统会自动检测上传内容中的敏感信息,并建议哪些应保留在本地。用户可预览隔离文件列表,自主决定数据流向。
目前支持的本地模型包括Gemma E4B及两个350亿参数的Qwen 3.6版本(其一经Perplexity后训练),安装无需终端命令,运行时可查看CPU/GPU占用及Token消耗。本地生成的Token不计费,结果产出后仍可继续对话,也可通过iPhone排队提交任务。
产品负责人坦言,纯云端方案在生成质量上通常更优,但并非所有任务都需要顶级模型。当隐私或成本优先时,混合计算提供了一条“可调节的尺度”。该功能仅限Apple Silicon Mac(建议32GB内存),面向Pro/Max订阅及企业客户开放。
这一设计回应了用户对AI隐私的深层焦虑,但本地模型能力上限仍是瓶颈。若未来能在保持安全的前提下提升本地推理质量,或将重塑AI工具的使用逻辑——不再是非此即彼的选择,而是按需动态分配的智能协作。
工具地址:Perplexity官网(海外网站需要科学上网)

Anthropic发布Fable 5.1,性能提升同时成本降低最高45%
Anthropic正式发布新一代旗舰模型Fable 5.1,在多项基准测试中超越前代及竞品,尤其强化了智能体在长周期复杂任务中的自主执行与动态调整能力。无论是编程、研究还是知识工作,模型都能在长时间运行中持续验证结果,避免偏离目标。
更受关注的是成本大幅下降:常规Token计费负载下综合成本降约25%,主要得益于缓存读取费用缩减;在高强度智能体任务中,节省幅度最高达45%。用户以“中等努力”模式运行,即可获得媲美上代“高努力”模式的输出质量。同步上线的Mythos 5.1也向权限用户开放。
此次发布正值Anthropic筹备IPO,最快9月底登陆美股。Fable 5.1被视为应对竞品下一代模型的关键筹码,其性价比优势或改变市场对高端模型“贵才好用”的认知。不过,成本下降是否伴随隐性妥协(如响应延迟或特定任务退化)尚需第三方验证。
还有就是,随着多家厂商竞相降价,大模型价格战已进入深水区,单纯靠性能领先难以维持壁垒,运营效率与生态绑定将成为下一阶段竞争焦点。
详情查看: https://www.aitop100.cn/infomation/details/34599.html

AITOP100-AI资讯频道将持续关注AI行业新闻资讯消息,带来最新AI内容讯息。
想了解AITOP100平台其它版块的内容,请点击下方超链接查看
AI创作大赛 | AI活动 | AI工具集 | AI资讯专区 | AI小说
AITOP100平台官方交流社群二维码:











