TechRadar刊文谈GPT-6与Astra:强大到难以理解
TechRadar资深记者Lance Ulanoff发文称GPT-6已到来,并以设问方式对强大到难以理解的Astra模型提出是否该拒绝的疑问。
浏览大模型领域的最新新闻、进展与深度报道。
TechRadar资深记者Lance Ulanoff发文称GPT-6已到来,并以设问方式对强大到难以理解的Astra模型提出是否该拒绝的疑问。
Meta Superintelligence Labs发布面向长程智能体任务的编码模型Muse Spark 1.3,较1.2版本工具调用减少约20%,token消耗减少约25%,已上线Muse Code和Meta模型API。
Meta为其AI模型Muse Spark推出“贡献者”定价机制,用户若同意分享提示词和输出用于训练,即可享受约95%费用折扣。
美国参议员桑德斯与众议员卡萨尔提出《禁止超级人工智能法案》,要求永久禁止开发部署超人工智能,并暂停高级AI研发直至建立安全标准。
OpenAI发布GPT-6 Astra,首次达到关键网络安全门槛,支持105万token上下文与电脑操作任务。官方称模型能力全面跃升,并宣布行业进入“AGI时代”。
据Sifted报道,瑞典法律AI公司Legora没有自建大模型的计划。该公司今年3月获5.5亿美元融资,并自1月以来完成五笔收购。
谷歌9月3日发布多项AI更新,Gmail、Docs和Keep的实时语音助手开始向订阅用户开放,同时推出Gemini 3.8 Flash模型。
OpenAI被曝在GPT-6中采用“循环深度”架构,俄罗斯初创公司Mostik则让模型间直接以高维向量通信。两者均绕开文本Token,给按Token计费的AI商业逻辑带来变数。
Hugging Face推出NeoMME多模态编码器,以单一Transformer同时处理文本和图像,无需独立视觉塔,文档检索速度较同类模型提升约一倍。
新研究显示,45款AI代理在真实浏览测试中无一满分,最高仅18分,交易完成能力最弱且普遍缺乏安全防护。
南京大学副教授蒋炎岩在《生成式软件工程》课上称,没有Token的CS学生应立即退学,并规定Token自费。该言论引发热议,折射出大模型对高校计算机教学的冲击。
Anthropic指责中国AI实验室通过非法蒸馏其Claude模型训练竞品,并利用暗网大规模创建虚假账户,引发美国国家安全担忧。
据雷峰网报道,中山大学团队提出SpatialSV方法,让多模态大模型在隐藏层学习三维几何表示。实验显示,以开源3D模型自动生成监督替代一半人工标注后,模型空间问答准确率仍接近全量标注。
9月3日,OpenAI的ChatGPT和Codex、Anthropic的Claude、xAI的Grok几乎同时出现服务中断,OpenAI称已采取缓解措施,事故原因尚不明确。
Anthropic发布Claude 5.1,推出Fable与Mythos两个版本,同模型拆分智力与执行权限。Fable在Ramp测试中连续运行38小时,可动态修正任务状态,展示长时Agent在状态管理、权限控制和科研编排上的进展。
据量子位报道,陈大年复出创立本地模型公司StartLux,首款27B模型在信通院MCP专项测试中综合排名第二,仅次于DeepSeek-V4-Pro。
据Android Authority报道,谷歌开始向部分AI订阅用户推出Gmail Live、Docs Live和Keep Live语音功能,用户可用自然语音指令操作应用。
Anthropic推出Claude后台控制电脑功能,用户可在AI处理任务时继续工作,目前面向Pro和Max用户beta测试。
9月3日,腾讯正式推出WorkBuddy金融版,为券商、银行、保险等机构提供覆盖投研、合规、信贷尽调等核心场景的AI智能工作台。
它石智航通用具身大模型AWE3.7近日连续完成系列真实任务,同一套“大脑”贯通工业、物流与家庭场景,并已获吉尼斯纪录和WAIC奖项。
谷歌9月3日发布Gemini 3.8 Flash和网络安全模型,同日美国联邦法官驳回司法部出售其广告交易平台的要求。Alphabet结束十多年最长月度连跌后,9月开局迎多项乐观信号,当日股价小幅反弹。
神秘具身团队发布多个机器人演示视频,展示自进化模型MVP,机器人具备物理理解与自主决策能力,引发行业关注。
韩国科技部选定Naver Cloud联合体开发网络安全AI基础模型,击败SK电信联合体,获政府提供256块英伟达B200 GPU支持。
CrowdStrike在Fal.Con大会介绍网络安全超级智能实验室,内部评测称其模型威胁检测率高出29%、威胁修复速度快6倍。公司强调安全AI开发应先保证准确性,再优化成本和速度。