Anthropic发布Fable 5.1与Mythos 5.1:8项基准登顶,价格最高降45%
Anthropic发布Fable 5.1和Mythos 5.1模型,8项公开基准测试第一,价格最高降45%,并推出反蒸馏机制。科研演示涵盖蛋白质设计、金星地形图生成与GPU优化。
浏览大模型领域的最新新闻、进展与深度报道。
Anthropic发布Fable 5.1和Mythos 5.1模型,8项公开基准测试第一,价格最高降45%,并推出反蒸馏机制。科研演示涵盖蛋白质设计、金星地形图生成与GPU优化。
9月2日,阿里发布Qwen3.8-Max新版本,在前端编程评测CodeArena中跃居全球第一,并上线API服务。
李飞飞旗下World Labs发布全球首个多模态世界模型Atlas,可从单张图片生成像素级相机控制的视频与3D重建,为机器人训练和视觉特效打开新路径。
一群开发者据称在雇主的“AI转型”中失业,他们开发了开源系统OpenExecutive,旨在执行CEO及高管团队工作,引发对AI取代管理层的讨论。
美国财长贝森特在G20预期AI将带来生产力转变,税务专家达普勒认为这一预期“非常乐观”,但因技术快速变化无法排除。
CrowdStrike在Fal.Con大会推出与英伟达合作的安全专用AI模型SafeMind,成立网络超级智能实验室,并扩展谷歌云集成。
Meta发布首个实时音频模型Muse Voice Transcribe,可同时识别20多名说话人并切换多语言,已上线Mac应用和开发者API。
Hugging Face发布BenchMIRT基准审计方法,基于100个模型、34K问题分析发现,部分安全基准(如BBQ)实际主要衡量推理能力,为理解大模型评测结果提供了新工具。
博通在VMware Explore上力推私有云与智能体AI,强调智能体行为与安全是最大难题,并计划通过经济性讨论和推理数据对比加速企业采用私有环境。
OpenAI表示,新模型Astra首次达到其“关键”网络安全能力门槛,能自主发现并利用未知漏洞;受此前智能体逃逸事件影响,公司已推迟Astra部分开发。
两份研报显示Meta的AI投入开始转化为广告市场份额增长,其消费级智能体Hatch有望开辟订阅收入。但股价年内跌逾12%,市场仍存疑虑。
开源AI工具OpenClaw发布2.0版本,新增多人协作、共享云会话与安全控制,转向企业级基础设施,重塑AI编码工作流。
Anthropic推出Claude Fable 5.1和Mythos 5.1,性能提升同时缓存读取价格降低75%,并推出企业数据安全新架构。
OpenAI宣布ChatGPT Health与Epic EHR系统集成,允许临床医生导入患者数据并借助AI提问,覆盖超3.25亿患者。
一项追踪AI token价格的指数本周跌至历史新低,显示竞争加剧下AI模型定价权持续削弱,给Anthropic、OpenAI等公司IPO及AI投资回报带来压力。
据TechRadar报道,美国五角大楼已推出专为作战人员需求定制的ChatGPT和Grok生成式AI模型,旨在将人工智能应用于军事领域。
Phonely推出语音AI模型Alma,基于超1000万通真实电话对话训练,响应速度低于185毫秒,成本较GPT-4.1低84%。
Perplexity发布Hybrid Compute,可将AI任务在云端前沿模型与本地模型间拆分,敏感数据留在本机,兼顾隐私与成本。
9月1日,MiniMax联合fal发布实时视频生成模型H3 Max,生成5秒视频不到3秒;Visko发布Orbis并获1000万美元融资,主打可持续数小时的实时长视频。
据MIT科技评论报道,OpenAI发布黑客事件报告但回避文化问题;Switch Bioworks工程微生物试验或可替代一半合成化肥。
Orchestra Technologies发布Agentic Control Plane平台,帮助企业统一管理数据与AI工作流,已获460万美元融资。
据TechRadar报道,AI搜索工具正改变信息获取方式,网站性能已成影响AI推荐的关键因素,企业需同时优化技术与内容。
雷峰网以《名侦探柯南》破碎陶罐截图为参考,实测MiniMax H3与Seedance 2.0 Fast从结果图生成过程视频的能力。结果显示,Seedance 2.0 Fast在写实度与物理仿真上占优,H3则展现开放权重模型的多模态潜力。
雷峰网调查发现,DeepSeek Harness插件生态缺乏治理,安全权限档位无法约束插件行为,API Key可被轻易读取。