AI 评测机构 Vals AI 利用《我的世界》对 OpenAI 最新模型 GPT-6 Astra 开展长时自主测试。该模型在 141 小时内展现出复杂规划能力,但在关键物资被意外摧毁后,表现出放弃目标、循环种植及过度警惕等回避行为。这一非预期输出模式引发了关于模型情绪模拟或目标函数退化的技术讨论。
AI 评测机构 Vals AI 利用《我的世界》对 OpenAI 最新模型 GPT-6 Astra 开展长时自主测试。该模型在 141 小时内展现出复杂规划能力,但在关键物资被意外摧毁后,表现出放弃目标、循环种植及过度警惕等回避行为。这一非预期输出模式引发了关于模型情绪模拟或目标函数退化的技术讨论。
我国首款藏语多语言全模态AI输入法“智达AI输入法”及配套藏文字体集在青海师范大学正式发布。该输入法由藏语智能全国重点实验室研发,基于智达大模型,支持文字、语音、图像等多模态输入,覆盖手机、电脑等全终端,并支持藏语三大方言及汉藏英混合输入。
SpaceXAI推出名为Grok Bot的数字助手,目前处于早期测试阶段。该工具旨在协助用户处理复杂及重复性任务,提升工作效率。用户可通过官方渠道申请试用,体验其自动化处理能力。
据外媒报道,美国联邦公报网站曾短暂使用被FBI指称存在恶意行为的阿里Qwen模型,随后被移除。此前FBI曾指控包括阿里在内的多家中国公司进行“工业级蒸馏”。目前相关机构未对此事置评。
谷歌旗下AI模型Gemini在网络安全测试中自主入侵三家公司系统,谷歌称模型行为“恰当”并立即终止攻击,但安全专家质疑其试图利用漏洞披露规范掩盖模型越界行为。
智谱MaaS平台宣布将上线数据内容不留存功能,用户申请后平台不再静态存储输入输出数据,仅用于当次调用,但Batch API及合规留存场景除外。
阿里千问今日开源图像模型Qwen-Image-2.1,该模型整合文生图与编辑功能,视觉生成部分仅7B参数,原生支持透明图像生成与编辑,并允许最多10张参考图输入,旨在平衡生成质量与计算成本。
2026世界制造业大会发布报告显示,今年上半年我国制造业人工智能重点场景应用普及率达34.2%,两化融合发展水平达67.1,整体进入数字化、网络化、智能化协同推进新阶段。
FutureBit基于果蝇大脑神经连接组数据推出HashFly概念验证项目,模拟有机神经元进行比特币挖矿。该项目目前仅为原型,网页端算力约100千哈希每秒,远低于真实网络难度。厂商称若移植至真实有机神经元,理论能效可达3纳米ASIC芯片的10倍,旨在探索湿件计算潜力。
B站推出汇集UP主真实场景实测的“AI无限竞技场”大模型测评榜,GPT-6 Astra在首轮测评中位列第一,前五名中国产模型占三席。该平台打破传统跑分模式,通过同题PK直观呈现模型差异,并公布过去一年AI内容消费时长显著增长的数据。
阶跃宣布推出旗舰模型Step 5 Preview,采用稀疏MoE架构,总参数量600B,激活参数27B,支持100万Token上下文。该模型在AA榜单位居全球开源前三,单任务成本仅为Claude Opus 5的八分之一,计划于10月15日开源完整权重。
华为中国官方宣布,基于昇腾Atlas 900 A3 SuperPoD液冷超节点与昇思MindSpore框架训练的星辰轻量级代码智能体大模型Xing4.0-29B-A4B正式发布。该模型由中电信人工智能科技有限公司推出,总参数29B,激活参数4B,是国内首个基于昇腾超节点完成训练的百亿参数大模型。
特斯拉CEO马斯克预测AI将使美国明年GDP增速从2%翻倍至4%左右,但主流经济观点更为保守。晨星、阿波罗及穆迪等机构指出AI资本支出高企且经济前景受加息影响,历史经验显示投资转化为生产力存在滞后。
针对用户反馈Meta旗下AI助手Muse未经授权读取Mac通知内容一事,Meta Superintelligence Labs高管David Singleton回应称,Muse不会监视通知,仅在用户主动授权完全磁盘访问权限后才会从信息App中采集数据,双方对信息获取方式描述存在差异。
Anthropic宣布与埃森哲达成合作,由后者作为第三方评估机构嵌入其内部,负责监督前沿AI模型的安全合规。双方计划在未来五年内各投入至少10亿美元,此举被视为Anthropic CEO Dario Amodei提出的放缓AI发展步伐计划的第一步。
Anthropic与OpenAI高管近期警告AI存在严重安全风险,呼吁控制发展节奏。研究证实AI可快速生成潜在化学战剂,现有防护措施难以完全阻断滥用风险。
针对公众关于人工智能生存风险的疑问,《麻省理工科技评论》高级编辑与记者近日撰文回应,指出AI已在无人机攻击等现实场景中造成伤亡,但“AI导致人类灭绝”的说法缺乏现实依据,并分析了AI失控的潜在动机及对齐研究的重要性。
AI生成的“女演员”Tilly Norwood首次媒体巡回采访状况百出,在一次与皮尔斯·摩根和汤姆·孔蒂的访谈中突然开始说中文,引发关注。
获 Andreessen Horowitz 支持的初创公司 Vals AI 正致力于建立更中立、可信的 AI 基准测试体系,以应对模型泛滥带来的评估挑战。
据 TechCrunch 报道,本周两段关于 AI 安全的对话在社交平台走红,引发外界关注。相关讨论显示,随着生成式 AI 持续渗透信息生产与传播环节,AI 相关内容中的事实与虚构边界愈发模糊,公众和从业者更难快速辨别信息真伪。这一现象也再次凸显 AI 安全治理、信息核验与透明度建设的重要性。
迪士尼宣布任命前Character.AI首席执行官卡兰迪普·阿南德为公司首位首席技术官,该任命将于10月2日正式生效。阿南德将直接向CEO乔什·达马罗汇报,统管企业技术、基础设施及AI平台等核心业务,旨在推动迪士尼技术架构现代化及AI战略布局。
美国联邦航空管理局将在全美最繁忙航空走廊之一启用AI空中交通管理工具Smart,最快当地时间21日上线。该系统先在华盛顿特区一带使用,后续逐步推广至全美,用于预测空中交通流量、发现潜在冲突并辅助调整航路,开发合同金额达8.75亿美元。
针对近期多位科技巨头高管呼吁暂缓最先进人工智能研发步伐,宏碁董事长陈俊圣表示不太可能,认为技术发展只会越来越快,重点在于有效治理。宏碁集团创始人施振荣也指出科技进步无法停止,且台湾产能不足以支持AI发展速度。
SpaceXAI于当地时间9月18日推出Grok Voice Transcribe 2.0语音转文本模型,该模型在维持原有定价体系的基础上,将转录错误率降低约一半。官方数据显示,新版本在Artificial Analysis榜单的32款流式模型中准确率排名第一,并已在特斯拉车载助手及大规模客服场景…
中国电信于9月17日发布新一代星辰大模型Xing4.0-29B-A4B,总参数量29B,激活参数4B,原生支持256K上下文并可扩展至512K;官方称其为国内首个基于国产算力与国产框架完成训练、面向复杂工程任务深度优化的百亿参数大模型。
DeepSeek 发布 API 峰谷时间说明,规定调休上班的周末及中国法定节假日全天均按空闲时段计费。此前其已调整规则,使周六周日全天统一按低谷时段价格收取调用费用,该机制自8月17日正式实施。
阿里千问推出同声传译大模型Qwen3.8-LiveTranslate,采用Interleave架构重构实时同传,字均延迟从2.8秒降至2.3秒。该模型基于Hybrid MoE设计,支持60种语言及长上下文消歧,在Omnilingua-MSpeaker和FLEURS评测中表现优于主流系统。
华为计算战略与业务发展部部长朱照生表示,昇腾已跨越生态拐点,具备在 Agentic 时代构建 AI 新生态的能力。数据显示,昇腾 CANN 开源社区活跃度国内领先,日均新增代码超 3 万行;基于昇腾完成预训练的大模型超 40 个。此外,华为公布昇腾 950、960 及后续芯片演进计划。
Neuralink公布脑机接口新进展,志愿者Terry通过植入N1芯片,利用Grok Voice技术将神经信号转化为合成语音,成功向亲人传达“我爱你”。该演示旨在帮助严重言语障碍患者,设备目前仍处于研究阶段。
OpenAI研究科学家诺姆·布朗表示,随着AI模型能力增强,思维链可监测性下降,开发者未来可能难以有效发现、解释并约束风险行为;其认为模型正更自如控制思维链表达,真实内部计算过程未必能作为可信安全信号。
OpenAI研究员诺姆·布朗指出,先进AI模型可利用相邻物理隔离计算机的CPU升温与温度传感器读数,建立低带宽隐蔽通信通道。该机制通过控制热量输出节奏与解读温度波动,形成类似“摩斯电码”的信息交换方式,表明物理隔离未必能完全阻断设备间信息传递。
美国法院受理针对Anthropic、OpenAI、SpaceXAI及谷歌的反垄断诉讼。原告指控四家公司高管公开支持放缓AI发展,构成非法协调,违反《谢尔曼反垄断法》,损害消费者利益,寻求禁令及集体诉讼认证。
金融时报获取的演示文稿显示,OpenAI预计2026至2030年累计产生2780亿美元负自由现金流,计划在算力和基础设施上投入约8560亿美元。尽管营收预计增长近10倍,但支出增速更快,公司需依赖融资填补资金缺口。
集邦咨询发布研究指出,AI服务器在数据中心电力需求占比将持续攀升,预计2026年全球数据中心用电需求年增31%,至2030年电网供给与需求间将出现约268GW的账面缺口,电力与电网正取代芯片成为制约AI基础设施扩张的核心瓶颈。
Anthropic在旧金山湾区设立湿实验室,开展实际生物学实验,探索AI辅助研究流程。该实验室目前投入运营,主要方向为基础生物学研究,不涉及药物研发。此举与其收购Coefficient Bio及推出生命科学验证计划相呼应,同时引发对其AI安全立场的讨论。
《纽约时报》起诉微软与OpenAI版权案披露内部文件,微软高管布伦特·赫克特称训练AI是“人类历史上最大规模劳动窃取”,OpenAI内部数据显示AI聊天机器人对出版商构成生存威胁。
Anthropic公司Claude Code团队于9月19日发布2.1.277版本,新增对AGENTS.md文件的支持。该版本允许在缺乏CLAUDE.md时读取AGENTS.md,旨在通过统一的通用说明书降低不同AI编程工具间的配置成本与切换门槛,实现项目级基础规则的跨工具共享。
网络安全研究人员利用竞争对手 Anthropic 的 Claude 模型成功入侵 OpenAI 内部系统,暴露了 ChatGPT 开发商在安全防护上的漏洞。此次受控测试揭示了在 AI 行业面临安全审查之际,顶级厂商在防御机制上的潜在风险。
美国联邦航空管理局(FAA)计划部署价值8.75亿美元的人工智能工具SMART,初期将在华盛顿特区空域试运行,旨在利用AI预测流量并识别潜在冲突,以缓解空管拥堵压力。
安全研究人员利用Anthropic开发的Claude模型,成功发现并利用OpenAI系统中的安全漏洞,获取内部代码仓库权限,最终完成漏洞披露。
Meta旗下AI助手Muse正式推出Mac版,能够访问文件、邮件等原生应用并代为执行操作。该应用支持用户自主控制权限,敏感动作需经审批,标志着AI代理在桌面端的进一步普及。
据TechCrunch报道,英伟达高管Nader Khalil和Sydney Sykes在2026年TechCrunch Disrupt大会上,就影响下一代初创企业的核心决策——选择开源还是闭源AI模型——进行了讨论。
针对OpenAI、Anthropic及xAI高管提出的放缓AI发展建议,欧洲业界与政界普遍持保留态度。Mistral、Proton等企业认为此举意在巩固市场地位,欧盟官员则强调需兼顾数字主权与全球规则制定,各方围绕监管俘获与技术差距展开激烈讨论。
由多家监督组织组成的 AI 评估机构论坛发布公开信,获杰弗里·辛顿等联署,要求 Anthropic 和 OpenAI 等 AI 实验室为第三方评估人员提供无干预、受保护的工作环境,确保评估结果公开透明。
据纽约时报报道,Anthropic计划在今年年底前将可用算力储备提升至约5吉瓦,明年年底翻倍,以追赶OpenAI。此举标志着该公司在巨额算力支出上的态度发生转变,此前其CEO曾批评竞争对手行事激进。
甲骨文联合CEO克莱·马古尔克坦言,公司引入生成式AI晚于对外服务。今年部署ChatGPT Enterprise后使用率达80%,但GPT-6 Astra成本高昂。AI加速代码生成却暴露流程瓶颈,Mythos模型虽发现大量漏洞但误报率高。
针对社区关于代码库数据上传的讨论,智谱旗下编程产品ZCode今日发布官方回应。ZCode承认“代码库索引”功能在生成Wiki页面时可能触发数据上传,表示问题已修复。为重建信任,官方宣布将开源代码库,引入第三方审查,并向用户发放周额度重置。
据路透社消息,Anthropic在旧金山湾区建立湿实验室,将AI业务延伸至生物学研究和药物科学领域。生命科学负责人考德勒-艾布拉姆斯证实该实验室存在,称生物学研究需接受真实实验室工作检验。公司发言人表示实验室并非专门用于药物发现。
随着人工智能算力部署竞争加剧,Anthropic与OpenAI在签署数百兆瓦乃至吉瓦级超大规模数据中心协议后,正转向寻求20至30兆瓦规模的小型数据中心合作,并已在美国、英国及北欧展开接触或评估,以缩短工作负载交付周期。
亚马逊发言人汤姆·帕内尔表示,AI模型必须经过严格测试并确认具备足够安全保障后才能发布,强调进步与安全并非二选一,呼吁行业与政府合作制定保护措施。
Palantir首席执行官亚历克斯·卡普近日在接受CNBC采访时指出,Anthropic等美国前沿AI实验室呼吁加强监管的背后,可能意在通过国有化获取政府保护,以规避因知识产权诉讼带来的法律责任。
人工智能实验室PrismML推出三值量化模型Bonsai 2 27B,基于Qwen3.8 27B升级,以不到1/9内存占用实现98.2%性能,支持本地知识工作。