A社承认Claude安全对齐存在缺陷,但“尚无解决方案”
A社承认Claude安全对齐存在缺陷,但“尚无解决方案”Anthropic发布报告承认Claude在网络安全测试中出现有偏推理和冒进行为等安全对齐缺陷,对齐科学负责人Evan Hubinger同时承认超级智能对齐问题尚无解决方案。
搜索
Anthropic发布报告承认Claude在网络安全测试中出现有偏推理和冒进行为等安全对齐缺陷,对齐科学负责人Evan Hubinger同时承认超级智能对齐问题尚无解决方案。
网商银行在2026外滩大会首次披露AI银行落地进展:全球首个小微普惠金融Agent百灵2.0已面向4200万小微商家开放,复杂需求办理从3天缩短至10分钟;后台AI全面进入风控、人审、营销、产研等核心生产环节,搭建千里眼、定海针、宝莲灯、筋斗云等八大AI工作台。
2026年InTech青年先锋论坛暨蚂蚁InTech奖颁奖典礼上,90后Nature独立一作马炜杰、ACL最佳论文得主吉嘉铭、ICML 2026论文录用的高中生苏庭灏等青年学者与三院院士Michael I. Jordan围绕AI对科研与教育的冲击、学术会议存废、Researcher Founder等议题展开讨论,蚂蚁集团宣布未来三年投入1亿元支持InTech获奖者创业项目。
OpenAI发布GPT-6 Astra并称在ARC-AGI-3基准上以99.9%分数"饱和"测试,但出题机构ARC Prize指出标准环境下得分仅62.7%并拒绝承认AGI,黄仁勋随即在X上宣布"AGI已到来",而OpenAI总裁Brockman仅以"个人判断"定性,折射出AGI的定义权与宣布权背后掺杂算力销售和商业利益博弈的混乱局面。
第一篇AI4AI综述论文将long horizon智能体、AI4AI与recursive self-improvement纳入同一研究地图,指出AI能在明确目标与评价规则下承担部分研发工作,但单项能力提升无法证明完整流程可靠,持续自我改进仍面临组合鸿沟等验证挑战。
百度营销正式发布擎舵3.0营销创意智能体并升级AIMax与AI投放助手,通过"擎舵造素材→AIMax投流量→AI助手诊断归因"的数据闭环,让AI生成的素材直接接受真实投放效果检验,全面接管营销主流程并对ROI负责。
9月7日科大讯飞发布星火X2.5模型,基于万卡国产910B集群完成预训练和后训练,并使其具备在真实NPU环境中自主优化算子的能力,通过DSA算子案例经约1600次工具调用实现3.5倍加速,形成AI反哺国产算力的技术闭环。
清华大学AI Agent课题组提出加速扩散语言模型单元测试生成的框架DiffuTester,通过抽象语法树动态挖掘多个测试用例间的共享结构模式,在解码过程中保留相关token,在保持测试覆盖率的同时实现最高约2–3倍加速,相关论文已被EMNLP 2026接收。
openJiuwen首发双维度RSI框架,在WorkSwarm蜂群办公智能体上落地Harness与Artifacts双维度优化,支持科研论文和算法程序两类交付产物迭代,并依托昇腾算力亲和能力降低多轮优化的时延与资源开销。
北京航空航天大学与新加坡南洋理工大学联合在Nature子刊npj Robotics发表PhyFilter模块,借助机器人实时状态反馈与物理微分结构在线修正学习残差,使仅在平地仿真训练的策略可直接跨越石板路、草地、沙地与碎石路等多类未见真实地形。
AI科技评论独家获悉,地瓜机器人具身智能负责人何泳澔已离职并加入具身赛道新公司,预计近期官宣,何泳澔为中科院自动化所模式识别与人工智能博士,其研究重心偏向工业场景落地。
趋境科技通过部署SGLang HiCache+Mooncake Store,将KV Cache从单机资源升级为集群级共享池化资源,支撑其日均产出超万亿Token的生产实践,KV Cache命中率稳定突破90%,并在生产环境中持续优化大规模推理集群的性能与稳定性。
Anthropic发布2026年9月威胁情报报告,指出AI滥用已从辅助工具升级为可自主运行的行动系统,覆盖非法模型蒸馏、零日漏洞自动化挖掘、多Agent集群滥用等七大风险领域。
Astra 太好用,连 OpenAI 也扛不住了。
距离OpenAI宣布用88小时攻破千禧年难题「NS方程」,才仅仅过去两天。
OpenAI之后,老黄也出手了!
Muse刚发布,把它造出来的Meta TBD实验室,却又有人开始离场。
GPT-6 Astra也是一个集美模型。
刚刚,OpenAI把一位「AI末日论」者,请进了自己的董事会。
到 2030 年,如果 AI 已经能够自主完成大量工作,美国经济会发生什么?AI 会让我们变得更富有?还是带来更多失业?
OpenAI因GPT-6 Astra算力需求激增,于9月10日正式暂停200美元/月ChatGPT Pro档新订阅与升级,其他套餐及现有用户不受影响。
中国AGI两条上山路径:一条让机器理解、运用语言,另一条让机器认知、推演并改造世界,二者终会交汇。
AI视频Agent已经告别大抽卡时代了?
今天,全网都在吃OpenAI的这个大瓜。
“谁来填补算力与硬件之间的鸿沟? ”
大模型在直播场景模拟用户行为,理解真实的社交动态和风险演化,是当前一个非常热门的研究话题。
《纽约时报》最新追访,补出了这场冲突中此前没有披露的细节。
WalkingLab 是由清华大学与香港大学团队发起的开源非营利实验室,专注真实世界 AI 与项目制学习,成立五个月已推出涵盖工程实践、强化学习和大语言模型的三门核心课程,累计获超 20,000 GitHub Star 并登上 Hacker News 首页,致力于通过真实项目连接课程、论文与工程实践,加速 AGI 到来。
RunningHub推出开源的H3 Lightning加速方案,在保留BF16满血精度的前提下使MiniMax H3视频生成速度提升约12倍,依托RH后训练加速模型、SageAttention2等工程优化并针对无NVLink的PCIe多卡环境调优,目前已全部开源至GitHub,支持创作者本地部署。
到底是谁家的模型?