AI NEWS / AI 新闻观察
本期整理值得关注的 AI 动态,附来源供进一步核对。
本期速览
1. AI快讯:B站大模型测评榜、Anthropic IPO推迟、剪映AI助手等
2. Jev:只输出概率判断的模型引开发者建近五百开源项目
3. xAI发布Grok 4.7,称面向编程与知识工作
B站上线大模型测评榜,称GPT-6 Astra居首、国产模型前五占三席,涵盖DeepSeek;Anthropic计划11月IPO;剪映发布AI助手小映;阿里开源Qwen-Image-2.1;苹果或推Siri AI家居屏;黄仁勋驳斥AI末日论;FBI称AI使用增605%。
来源:极客公园 · 2026-09-21T01:01:53+00:00
前OpenAI研究员Diogo Almeida推出Jev,称其为不生成文字、只输出概率判断的System One模型。材料称上线数天已有近五百个开源项目,TypeSafe AI定价每百万输入token 0.042美元、输出免费,已有洗衣提醒等判断案例。
来源:极客公园 · 2026-09-21T11:02:43+00:00
xAI发布新一代大模型Grok 4.7,定位为编程与知识工作模型。公司称其复杂任务处理能力提升,运行速度和价格体系与前代相同,并以更低成本参与竞争。
来源:cnBeta · 2026-09-21T20:57:32+00:00
深度集成Gemini、运行Android的Googlebooks将于10月4日上市,宏碁型号起售价899美元,其余超1000美元。其Magic Pointer可用光标激活AI,分析屏幕内容并按上下文给建议,如把邮件日期转为日历预约。
来源:Solidot · 2026-09-21T14:32:25+00:00
OceanBase团队Data Agent方案以90.62%准确率登顶DAB基准,为首个突破90%的参评方案,基于国产大模型GLM-5.2,超过多项基于GPT、Claude等海外模型构建的方案。该方案内部代号Scout,相关能力将融入OceanBase DataPilot。
来源:雷峰网 · 2026-09-21T07:20:00+00:00
Saturn研究称,ChatGPT、Claude、Copilot、Grok和Gemini等主流AI回答财务问题平均57%错误;测试18种模型、逾百问题、逾万提问,错误含计算错误、遗漏税收变更和幻觉;付费及较新模型更准,最好者仍有39%错误。
来源:Solidot · 2026-09-21T13:39:37+00:00
智谱称MaaS平台将于近期推出“数据内容不留存”功能:模型调用输入、输出不静态存储,仅当次调用中临时使用,不用于训练;可通过控制台申请开通。例外为Batch API、Files API等功能型存储,及依法或核查违规滥用时可能留存30天及以上。
来源:Solidot · 2026-09-21T06:44:05+00:00
Anthropic、OpenAI、Google和SpaceXAI遭美国联邦法院反垄断诉讼。原告称四家企业通过公开表态和协调行动,就放缓AI发展达成非法协议,限制竞争并降低ChatGPT、Claude、Grok和Gemini等服务消费者价值。
来源:cnBeta · 2026-09-21T13:02:49+00:00
消息人士称,OpenAI与Anthropic曾磋商一份具法律约束力的协议,计划互相对对方大模型开展压力测试。该信息此前未披露,磋商早于OpenAI相关网络安全事件与业内警示;OpenAI正重新审视安全策略。
来源:cnBeta · 2026-09-21T14:41:36+00:00
桥介数物推出全身运动控制基座模型及 RoboCraft AI 平台,用户上传视频可提取动作、仿真并部署实机,称机型和环境正常时半小时内完成;目前每款机器人各需单独模型,跨本体通用模型未实现,抓取仍需训练。
来源:极客公园 · 2026-09-21T04:01:49+00:00
本文使用 AI 辅助整理,重要信息请以原始来源为准。