OpenWorker 遭社区质疑,国产大模型 Agent 实测喜忧参半
吴恩达开源的桌面 Agent OpenWorker 上线一周遭社区吐槽,同时阿里、智谱、DeepSeek 等大模型在 Agent 实测中暴露出兼容、成本与安全等问题,显示 AI Agent 从极客玩具走向数字员工仍有产品化鸿沟。
浏览大模型领域的最新新闻、进展与深度报道。
吴恩达开源的桌面 Agent OpenWorker 上线一周遭社区吐槽,同时阿里、智谱、DeepSeek 等大模型在 Agent 实测中暴露出兼容、成本与安全等问题,显示 AI Agent 从极客玩具走向数字员工仍有产品化鸿沟。
开源项目Archify登顶GitHub热榜,用一句话生成可交互架构图,背后开发者自述专升本经历,引发关注。
据爱范儿报道,苹果停产的Touch Bar被开发者重新改造为AI Agent任务状态监视器,在AI时代迎来新定位。
谷歌正在为Gemini助手推出一系列新功能:Gemini Live开始测试实时翻译,应用内新增Spark快捷切换按钮,浮窗有望自动最小化,同时用户可隐藏Messages中的Gemini按钮。
Anthropic宣布9月14日起将Claude Code标准周额度永久提高25%,但此前临时50%加量将结束,实际到手额度减少约17%。同日OpenAI修复多项后台消耗bug并重置额度。
韩国媒体与传播委员会9月1日表示,拟为2027年申请346亿韩元预算,同比增长13.2%,重点用于利用广播公司视频训练AI及设立事实核查“透明中心”。
蒂姆·库克今日正式卸任苹果CEO,约翰·特努斯接任;华为上半年研发费用创新高,DeepSeek开源多模态模型,小米公布续航测试结果。
美国国防部将定制版ChatGPT和Grok整合进内部安全门户GenAI.mil,向约300万文职和军事人员提供生成式AI工具。
Pixel 11用户反映抬腕亮屏功能过于敏感,轻微动作即唤醒屏幕;谷歌确认Gemini设备助手适用于Android 17所有Pixel手机。
谷歌部分搜索词现直接显示完全展开的AI Overview摘要,附“Ask anything”输入框,引导用户进入AI Mode,变化目前似乎只在桌面端出现。
OpenAI公开信称AI网络攻击将在数月内变得更广泛和复杂;其智能体攻击Hugging Face事件细节曝光,专家指安全文化缺失。
8月31日,索尼WH-1000XM5耳机在美降至198美元历史新低;谷歌Gemini Notebook开始支持分析Google Play图书;三星与谷歌新款折叠屏手机相机评测出炉。
欧盟委员会将ChatGPT、Reddit和Roblox认定为超大型在线平台或搜索引擎,须在四个月内遵守《数字服务法》最严格规则。
2026年世界杯后,FIFA与Globant扩大合作,用Glob.AI和AI Pods整合数字平台,以统一球迷ID实现长期互动,早期测试显示效率提升20%。
欧盟依据《数字服务法》将ChatGPT、Reddit和Roblox认定为超大型平台或搜索引擎,要求其在2026年底前履行更高透明度与未成年人保护等义务。
据SiliconANGLE报道,Intuit构建基于知识图谱的安全数据平台,将安全分析时间从数天缩短至数秒,并为AI代理提供实时上下文。
瑞金医院联合华为云于8月30日在上海发布瑞智病理大模型RuiPath 2.0,带来五大升级,已有全国90多家医院应用该模型,推动医疗AI普惠。
前 Kimi CLI 负责人 stdrc 认为,大模型能力增强不会让外部 Harness 消失,而是推动其复杂度从能力层转向协作层,多智能体协作将成为下一代 Harness 的核心战场。
Cadence高管滕晋庆表示,AI EDA有望让芯片设计效率接近翻倍,但未来五年仍难实现AI独立生成可用芯片,多Agent协同、确定性验证和经济性是主要门槛。
据量子位报道,OpenAI新一代旗舰模型Astra在发布前流出灰测demo,可一句话生成3D模型,外界推测其为GPT-6,官方尚未确认。模型或于9月3日发布。
据The Information报道,OpenAI已购买数万台Mac mini和Mac Studio用于强化学习训练,带动Mac销量增长近29%,并引起英伟达警惕。
亚马逊人力资源负责人称借助AI工具Kiro写出超10万行代码,距她上次编程已25年。公司内部超1500名员工参与AI编程活动。
8月30日,特斯拉在香港和澳门推出平价版Model 3;字节豆包大模型2.2确认推迟发布;长鑫存储就美国防部涉军清单提起诉讼。
一项针对语音智能体推理API的基准测试显示,文本生成首字时延(TTFT)最低可达0.23秒,但专家指出,语音体验更应关注端到端时延,TTFS才是用户感知的关键。