人工智能 Perplexity用GPT-6 Astra执行端到端系统任务 Perplexity对GPT-6 Astra的使用,已经从内容生成扩展到软件修改和生产环境监控。OpenAI称,相较早期模型,Astra运行过程中所需的人工检查更少。这个案例的关键不只是模型能完成更多任务,而是企业开始把评估重点转向系统可靠性、权限边界和人机协作机制。
人工智能 媒体称小米投资AI芯片创企获新融资,大模型公司跟投 一则媒体报道将小米投资的AI芯片创业公司推向市场焦点:其被称完成10亿规模融资,并获得知名大模型公司跟投。现有公开线索未披露企业名称、融资币种、投资方名称及产品进展,相关金额和交易细节仍待官方确认。若报道属实,这笔交易的重点不只在融资额,更在于模型公司是否正通过股权投资提前介入国产AI算力供给与软硬件协同。
人工智能 媒体称OpenAI与Anthropic谋求投资级评级,瞄准11.7万亿美元债市 OpenAI与Anthropic的资本市场叙事,正从潜在IPO延伸至债券融资。媒体报道称,两家公司希望在上市后争取投资级信用评级,进入规模约11.7万亿美元的投资级债市。其背后是数据中心、芯片和模型训练带来的长期资本开支压力,但评级与发债仍取决于财务透明度、现金流和正式资本市场文件。
人工智能 媒体称GPT-6、Claude、Grok轮番升级,竞争转入下半场 GPT-6、Claude和Grok被报道同时纳入新一轮模型竞争,但公开线索尚不足以确认具体版本、能力与上线安排。真正的变化不只是头部厂商更新更密集,而是企业采购和开发团队开始面对多模型并存、频繁迁移、评测失效与合规治理成本上升的问题。
人工智能 OpenAI等四家厂商密集更新,企业模型疲劳升温 Anthropic、Meta、Google与OpenAI近期密集更新模型,行业媒体将这一现象概括为美国大模型进入高频迭代周期。对企业而言,问题不只是是否追赶最新模型,更在于每次更新都可能触发能力评测、成本核算、安全审查与应用回归测试。模型疲劳的实质,是模型能力进步速度开始超过部分企业的验证和部署节奏。
人工智能 媒体称Moonshot携Kimi K3筹备港股IPO,开放模型竞争升温 TradingKey将Moonshot筹备港股IPO与Kimi K3、OpenAI和Anthropic潜在上市叙事联系起来。不过,截至目前,Moonshot官方尚未公布港股IPO申请、招股书或Kimi K3的完整产品资料。若上市计划获得确认,市场将更关注其能否把模型能力、开放策略和企业服务转化为可验证的商业模式。
人工智能 Meta据报发布Muse Spark 1.3,瞄准编码Agent竞争 Meta据报推出Muse Spark 1.3,媒体标题将其编码能力与GPT-5.6进行比较,并将产品定位指向大模型及AI Agent竞争。不过,Meta官方尚未公布可核验的模型卡、定价、上下文长度、基准测试和部署方式。对开发者而言,关键不只是单项编码成绩,而是模型能否在真实代码库中稳定完成理解、修改、测试与修复闭环。
人工智能 ChatGPT、Claude与Grok同日中断,故障原因仍未明 9月4日凌晨至中午,多家媒体集中报道ChatGPT、Claude与Grok出现服务中断,部分线索称故障持续超过3小时。Gemini也被指有用户报障,但尚无足够证据证明其与前三个平台存在共同故障。由于各家公司尚未公布统一原因和完整恢复时间,这更像一场需要继续核实的跨平台可用性事件,而非已经确认的“全球AI集体宕机”。
人工智能 多家AI服务被曝中断,OpenAI、Anthropic与SpaceXAI在列 9月3日晚至4日凌晨,多家媒体集中报道OpenAI、Anthropic等AI公司的模型服务出现中断,部分报道还将SpaceXAI列为受影响对象。现有线索能够确认的是“多家服务商被报道出现异常”,但尚不足以证明故障由同一原因引发,也不能确认所有平台在同一时间、同一范围内完全不可用。对企业用户而言,这再次凸显多供应商接入、降级策略和状态监控的重要性。
人工智能 谷歌据报最快今日发布Gemini 3.8 Flash模型 谷歌新一代Gemini 3.8 Flash模型进入发布倒计时。多家RSS来源称,该模型内部代号为“Skimaki”,最早可能在2026年9月3日亮相,并将编程能力作为竞争重点。不过,目前尚无谷歌官方公告,模型性能、定价、上下文能力和开放范围仍属未知。真正影响开发者选择的,将是实际代码任务表现、响应速度与调用成本,而不只是版本号升级。
人工智能 ClawBench实测Claude、GPT与Gemini真实网站成功率约33% 一项由ClawBench开展的真实网站任务测试显示,Claude、GPT和Gemini等AI agent的整体任务成功率约为33%。这一结果并不意味着模型无法完成网页操作,而是说明当任务涉及登录状态、动态页面、工具调用、流程依赖和异常处理时,模型的稳定执行能力仍明显不足。由于目前公开信息有限,测试样本量、任务类型、模型版本及评分标准尚未完整披露,33%应被视为阶段性评测结果,而不是对所有模型能力的最终判定。
人工智能 AWS将OpenAI、Meta与Anthropic模型引入GovCloud 媒体报道称,AWS正在扩大GovCloud中的大模型供给,OpenAI、Meta和Anthropic等厂商的模型被纳入面向政府客户的云环境。这意味着政府机构或可在既有合规基础设施中获得更多模型选择,但实际部署仍取决于模型版本、区域可用性、数据处理方式及监管授权。AWS的竞争焦点正从“是否提供生成式AI”转向“能否把多模型能力变成可采购、可审计、可治理的服务”。
人工智能 索尼华纳起诉Anthropic,Claude训练数据争议升级 索尼与华纳将Anthropic及其Claude模型卷入新的训练数据版权争议。现有新闻线索称,诉讼指控Anthropic通过盗版下载获取受版权保护内容,并用于模型训练。案件的关键不只是单个数据集是否合法,还在于AI公司是否需要证明数据来源、授权链条与内部使用记录。由于目前未提供起诉书、案号及Anthropic正式回应,相关指控仍应视为诉讼主张,最终责任需由法院审理认定。
人工智能 Anthropic被曝拟70亿美元收购芯片初创MatX Anthropic被曝曾考虑收购AI芯片初创公司MatX,潜在交易金额据称最高约70亿美元。若消息属实,这将使Anthropic从芯片团队建设进一步走向对外部芯片设计能力的整合,也反映出大模型公司正试图把算力竞争延伸至底层硬件。不过,现阶段交易尚未获双方官方确认,金额、时间表及收购方式均不明确。
人工智能 Anthropic称Claude在RSI实验中击败人类研究员 Anthropic最新RSI实验引发关注:媒体报道称,Claude在特定测试中击败人类研究员,相关训练效率超过人类研究员1.5万倍。真正值得讨论的并非单一“胜负”,而是模型能否稳定参与实验设计、代码修改和结果验证,以及这一效率数字是否具备可复现、可比较的统计基础。当前公开线索尚不足以回答这些问题。