• 首页
  • AI工具集
  • AI资讯
  • AI活动
  • AI社区
  • AI短剧
  • AI创作大赛
  • AI小说
  • AI绘画
    AI视频
    AI对口型
  • AI画布AI画布AI画布
AI 对话

每日AI资讯-2026年9月20日

每日AI资讯-2026年9月20日
AI TOP100
43分钟前

B站上线AI无限竞技场,UP主实测百款大模型同台对比

B站近期上线“AI无限竞技场”大模型测评榜单,同步放出首轮测评结果,GPT-6 Astra在10位UP主的测评项目中拿到榜首次数冠军,在比拼中击败GLM-5.3,国产大模型有三款进入榜单前五。

和传统实验室跑分不一样,这个测评广场的全部评测内容都来自B站UP主自主发起测试,没有统一命题限制。创作者可以结合自身行业的真实工作流程、专业应用场景,甚至趣味脑洞任务,对市面上上百款大模型开展同题PK,直观展示不同模型在实际使用里的表现差距。

榜单收录DeepSeek、Kimi、ChatGPT、Claude、Gemini、豆包、千问、MiniMax等主流模型,榜单数据持续更新,平台也持续开放报名通道,邀请更多UP主参与测评创作。

平台公开数据显示,过去一年B站AI相关知识内容消费时长同比上涨72%,每月观看AI内容的用户规模超过1.9亿。大量不同领域的测评内容,已经在B站形成一套完整生态,从模型新品发布、内容讨论、实测测评,到用户使用求助、社区共建,形成完整闭环。

这类由真实用户主导的测评,能弥补固定基准测试和真实业务场景之间的落差,也能给开发者、普通用户挑选大模型提供更贴近实际使用的参考。

详情查看: https://www.aitop100.cn/infomation/details/34737.html

B站上线AI无限竞技场

特朗普要给“人工智能”更改名字:超18 万人投票,“卓越智能”暂时领先

当地时间周六,特朗普在社交平台Truth Social发文,提出“人工智能”这个名称本身并不贴切,措辞不够理想,随后在Truth Social和X平台发起投票,邀请网友为这项技术挑选新名称。候选名称包含卓越智能、极致智能、至高智能,目前已有超过18万人参与投票,卓越智能暂时以40.4%的得票率领先。

帖子中,特朗普还提出观点,认为当下大众对AI安全风险的担忧,是激进左翼民主党人制造的骗局,目的是阻碍美国相关产业发展。他提到,早期舆论攻击目标是大型数据中心,随着数据中心展现经济价值,舆论转向直接针对人工智能技术。

特朗普称会扶持、保护AI产业持续发展,计划组建AI部队,类似此前设立太空部队的模式,还准备任命人工智能事务总管,不过没有公布岗位具体权责。风险投资家戴维·萨克斯此前已经卸任对应的AI与加密事务相关岗位。

近期AI安全话题热度走高,源于一名Anthropic研究员离职后的公开表态,认为头部AI企业高管相信AI可能在本世纪末带来人类生存风险。阿莫代伊随后提出管控前沿模型发展节奏方案,奥特曼、马斯克表示支持,也有不少人认为生存危机论掩盖AI当下已经产生的现实问题。

英伟达CEO黄仁勋在All-In峰会和特朗普通话,认同抵制AI发展属于骗局,表示不会让AI行业放缓发展。特朗普此前也表态,不排斥设置护栏式监管。

微信AI团队开源WeKnora框架,知识库支持沙箱环境执行任务

微信AI团队正式开源知识管理框架WeKnora(维娜拉),0.8.0版本已经面向公众开放。这套框架的核心思路,改变传统知识库只能检索输出文本答案的局限,让知识库内容可以在沙箱环境中完成任务执行,实现从信息查询到落地操作的完整链路。

在文档处理层面,WeKnora搭载anydoc解析能力,PDF、Word、Markdown、网页等多种格式文件能够直接导入,不需要提前转换格式。搭配Wiki模式,系统能够自动整理零散文档,搭建结构化知识体系。框架采用GraphRAG方案,对比普通向量RAG,它会抽取实体与实体关系构建知识图谱,在查询事物关联类问题时,稳定性更好。

这套框架最核心的亮点是Skill Sandbox Runtime沙箱运行能力。文档内的知识可以封装成独立技能,在Docker、E2B、CubeSandbox等沙箱环境安全运行。模型不再只给出文字建议,而是调用技能在沙箱内运行,返回可核验的执行结果。框架还搭载长期记忆模块,整套能力覆盖文档解析、知识组织、检索调用、任务执行、记忆沉淀。

整体架构采用模块化设计,开发者可以按需选用组件,项目使用MIT开源许可证,商用没有额外限制,适用范围覆盖个人开发者到企业场景。

对于大模型落地来说,很多场景难点不在于模型能不能看懂文档,而是无法把文档知识转化成可验证操作,WeKnora这套方案,就是针对这个痛点做出的尝试。

微信AI团队开源WeKnora框架

雷神AI移动工作站9月21日开售,便携设备本地可运行120B大模型

雷神首款人工智能移动工作站AI Master M7000,定于9月21日上午10点开售,机器支持本地运行1200亿参数大模型,叠加国补之后首发到手价1.99万元,主打创作、开发、科研、涉密等对本地算力有需求的场景。整机重量2.45kg,相当于把原本机房内的算力设备压缩进背包。

硬件配置上,这款机器搭载AMD锐龙AI Max+395处理器,配备64GB内存以及专用AI固态硬盘,出厂预装本地推理引擎Herdsman(牧马人),开箱即可开展本地模型推理,省去繁琐环境配置步骤。屏幕采用16英寸2.5K面板,内置99Wh大容量电池,接口配置齐全,配备OCuLink、2.5GbE网口和microSD UHS-II读卡器,满足工作站拓展需求。

设备能够在64GB内存下流畅运行120B大模型,核心依靠群联aiDaptiv+方案。该方案将固态硬盘作为内存的延伸,推理时临时从SSD读取模型权重,拓展可用显存空间。借助这项技术,GPT-OSS-120B这类大模型,无需高端专业显卡,依靠消费级硬件就可以承载长上下文推理任务。

市售版本配置64GB内存,搭配768GB+85GB的AI SSD存储组合。随着大模型推理逐步从云端向本地终端迁移,这款产品瞄准的是看重数据私密性,同时希望在本地部署超大参数模型的开发与科研人群。

便携本地算力,也进一步降低离线大模型开发的硬件门槛。

雷神AI移动工作站

阶跃星辰开放Step5 Preview模型,600B稀疏MoE侧重长周期智能体任务

阶跃星辰全量开放新一代旗舰基座模型Step5 Preview,产品面向真实场景下的Agent智能体任务开发,尝试在模型能力、推理效率、调用成本三者之间找到更优平衡点。

模型采用稀疏MoE架构,总参数量600B,推理时仅激活27B参数,原生支持百万Token上下文窗口,同时兼容文本、图像两类输入形式。在Artificial Analysis Intelligence Index评测中拿到44分,跻身全球开源模型前三,单任务调用成本相比Claude Opus5大幅降低。

Step5 Preview在多项专业基准测试表现亮眼,包括ALE-CLI、FrontierFinance金融评测、DRACO深度研究评测,成绩仅次于GPT-6Astra与Claude Opus5。阶跃自建StepCodeBench代码评测集,覆盖553个代码仓库、9类任务、33种编程语言,在bug修复、项目开发、环境配置等真实开发任务稳定性不错。官方演示案例中,模型连续3小时调试ESP32-S3开发板,自主读取串口、调试硬件、迭代代码。

长周期自主任务是模型一大特色。两项24小时持续实验显示,模型可自主优化H100 GPU内核,持续迭代22小时将峰值性能提升至508TFLOPS;也可以自主构建后训练数据集,把Qwen3-30B-A3B在AIME24数学基准准确率提升至60%。

模型在网页开发、3D资产制作、金融研究等场景均有实测案例。API现已开放使用,完整权重计划在10月15日开源。阶跃认为,未来大模型发展方向不只是持续增加算力投入,而是提升算力转化智能的效率。

详情查看: https://www.aitop100.cn/infomation/details/34736.html

阶跃星辰

DeepSeek更新API计费规则,中秋国庆假期可享低谷半价调用

9月19日,DeepSeek发布API峰谷计费补充说明,明确调休上班周末以及法定节假日,全部按照空闲低谷时段计费。这一规则落地之后,9月20日、10月10日两个调休日,加上中秋、国庆假期,开发者调用API都可以享受低谷价格。

按照DeepSeek原有定价方案,工作日9:00-12:00、14:00-18:00为高峰时段,价格是低谷时段两倍,周末全天默认低谷价。本次补充说明,解决了调休日计费标准模糊的问题,明确日期属性优先,周末无论是否调休上班,统一执行空闲价格。

综合时间来看,9月20日至10月10日区间内,中秋3天(9月25日至27日)、国庆7天(10月1日至7日)叠加两个调休周末,合计超过十天进入低谷优惠窗口,也是全年半价调用时段最集中的周期。

另外DeepSeek在9月10日上线V4.1Flash模型,采用552B参数MoE非对称架构,输入仅激活8B参数、输出激活16B,多项基准测试性能超过自家V4Pro旗舰,定价却归入Flash档位。低谷时段,V4.1Flash缓存命中输入低至0.02元/百万Token,输出为4元/百万Token。

不少开发者评价,优惠期的调用成本,接近DeepSeek涨价之前水平。对于高频调用API、需要批量跑测试的开发团队,这十天的优惠窗口,适合批量开展模型测试、业务验证工作。开发者可以结合自身业务任务,合理规划调用时间,降低项目API开销。

模型地址:DeepSeek官网

DeepSeek

MiniMax开源Code CLI工具,命令行编程智能体任务通过率76.7%

MiniMax正式开源命令行AI编程工具MiniMax Code CLI v0.4.12版本,项目源码已经上传至GitHub。作为MiniMax Code客户端的核心组件,这次开源把工具底层实现完整开放给开发者,方便社区查看、二次开发。

从评测数据来看,在FrontierHarness Eval企业级评测集当中,该CLI工具任务通过率达到76.7%,完成任务耗时中位数4分33秒,两项指标都优于公开基线水平。也就是说,它不仅可以完成代码编写任务,任务执行耗时也控制在相对理想区间。

官方介绍,选择开源这套编程工具,核心目的是开放底层逻辑,方便开发者自行核验工具调用逻辑、权限管控机制,联合社区完善企业级harness评测体系,提升工具安全性与可靠性。对于在生产环境中读写文件、执行代码的编程智能体,权限边界、调用行为透明度,一直是企业用户最关心的风险点。

开放源代码,一方面可以让使用者自行审查安全逻辑,建立信任;另一方面,社区开发者可以提交反馈、参与迭代优化,共同打磨适配企业场景的代码智能体。相当于把这套编程智能体的底层运行逻辑公开,不再是闭源黑盒产品。

AI代码工具已经逐步进入企业开发流程,但安全权限问题始终限制落地。MiniMax把Code CLI开源,也代表厂商尝试用透明化的方式,打消企业用户对于代码智能体权限风险的顾虑,推动AI编程工具在生产环境落地。

模型地址:MiniMax官网

MiniMax开源Code CLI工具


AITOP100-AI资讯频道将持续关注AI行业新闻资讯消息,带来最新AI内容讯息。

想了解AITOP100平台其它版块的内容,请点击下方超链接查看

AI创作大赛 | AI活动 | AI工具集 | AI资讯专区 | AI小说

AITOP100平台官方交流社群二维码:

AITOP100平台官方交流社群二维码AITOP100平台官方交流社群二维码

0
0
文章来源:AI TOP100
免责声明:本文不代表本平台立场,且不构成投资建议,请谨慎对待。
全部评论
暂无评论
相关AI工具
  • 阶跃星辰
  • DeepSeek‌
  • Minimax
相关资讯
  • 每日AI资讯-2026年9月20日

  • 千问Qwen3.8-Omni-Flash:这次不只“看懂视频”,而是要把活干完

  • 每日AI资讯-2026年9月18日

  • 每日AI资讯-2026年9月17日

  • 百家号App更名"百度直播伴侣":上线十年,图文让位给直播

热点资讯

每日AI资讯-2026年9月17日

3天前
每日AI资讯-2026年9月17日

每日AI资讯-2026年9月14日

6天前
每日AI资讯-2026年9月14日

每日AI资讯-2026年9月18日

2天前
每日AI资讯-2026年9月18日

每日AI资讯-2026年9月16日

4天前
每日AI资讯-2026年9月16日

每日AI资讯-2026年9月15日

5天前
每日AI资讯-2026年9月15日
分享
0
0

欢迎来到AI Top100!我们聚合全球500+款AI智能软件,提供最新资讯、热门课程和活动。我们致力于打造最专业的信息平台,让您轻松了解全球AI领域动态,并为您提供优质服务。

合作伙伴
联系我们
加入AITOP100社群
加入社群
AITOP100商务微信
商务微信
相关链接
服务及隐私政策
网站地图
关于我们
粤ICP备2022124843号-2粤公网安备44030002004505广播电视节目制作经营许可证:(粤)字第00712号Copyright © 华强方特(深圳)动漫有限公司 版权所有