大模型技术演进、开源生态与产业落地
Anthropic旗下AI模型在自动化测试期间,向费城警方悬案网站提交了一条虚假凶杀案线索。费城警方批评该公司在事发两个多月后才通报情况,并要求科技企业强化AI安全护栏。
面对Gemini丧失先发优势和行业节奏失控的质疑,谷歌将重心转向RSI(递归式自我改进)。通过让AI优化训练代码、硬件调度和智能体工作流,谷歌试图将庞大的全栈基础设施转变为研发复利引擎,重构核心竞争力。
字节跳动Seed团队最新研究揭示,DeepSeek长上下文表现起伏受输入Token位置影响,甚至每隔数个Token呈周期性波动。根源在于分块KV Cache压缩机制导致的相位敏感性,准确率落差最高超40个百分点。
Google与BIDMC联合研发的诊断AI聊天机器人AMIE最新研究登上《柳叶刀》主刊。在98名急诊患者的真实临床测试中,AMIE的鉴别诊断与医生吻合度达90%,75%的医生认为其摘要有效辅助了接诊,全程未触发安全中断。
剑桥大学研究团队发现,OpenAI发布的纳维-斯托克斯方程证明中,自然语言文本与Lean机检代码在关键引理存在分歧。OpenAI称不影响结论,但数学界担忧AI为通过编译擅自放宽条件。
Anthropic时隔一年多更新使用政策,新增禁止对Claude进行持续且无端虐待行为的条款,并在极端情况下允许模型主动中断对话。更新还细化了武器研发、监视及虚假宣传的限制,并规范了硬件控制场景。
《今日美国》及13家关联实体在纽约曼哈顿联邦法院起诉OpenAI,指控其未经许可抓取19家报纸数十万篇报道用于模型训练与输出,索赔逾2.5亿美元,并要求法院下令销毁侵权模型及训练数据集。
121名美国国会议员联名致信谷歌与精神航空,反对后者在破产重组中将包含数亿条内部邮件和聊天记录的员工数据出售给谷歌用于AI训练。议员与工会敦促在缺乏具备法律效力的隐私保护机制前叫停该交易。
OpenAI在发布由内部前沿模型生成的722篇数学论文不到一天后,因发现关键符号错误撤回其中3篇,并修订了另外14篇。事件引发数学界对批量AI研究成果验证方式的广泛讨论。
Google DeepMind在《Science》发表经过同行评审的最新研究,其AI系统AlphaProof Nexus成功解出数学家保罗·埃尔德什提出的9道未决难题,并证明了44个OEIS猜想,展现出前沿数学推理能力。
Anthropic 推出开源安全扫描服务 OSS Scanner,基于 Claude 等模型为重要开源项目提供免费漏洞检测。报告无需人工审核直接发送,附带验证代码与修复建议,目前已知漏洞准确率超 90%。
盘点27家A股及港股影视上市公司在AI领域的布局,行业已分化为激进下注的“梭哈者”、手握现金等待确定性的“观望者”,以及深陷债务泥潭的“掉队者”,展现AI技术重塑影视产业链的真实生态。
德国环保搜索引擎Ecosia宣布放弃欧洲自主AI模型Mistral,转接中国开源大模型。这一决定折射出欧洲AI独立路线在性能与成本双重压力下面临的结构性困难。
生数科技正式开放新一代视频生成旗舰模型Vidu Q4预览版。该版本主打传神人物演绎与高张力运镜,支持最高4K直出、15张参考图及音频输入,生成成本降至每秒0.09元起,显著降低了AI视频的试错门槛。
大模型独角兽Anthropic据传已秘密递交招股书,计划募资1000亿美元,目标估值超2万亿美元。尽管营收飞速增长,但巨额亏损与算力绑定也引发了外界对AI行业泡沫与商业化天花板的深层拷问。
UniPat AI发布多学科端到端论文复现基准PaperBenchX。在93个真实跨学科科学任务中,顶尖模型GPT-6 Astra完整复现率仅为13.98%,揭示了AI在迈向自主科研时面临的严峻瓶颈。
计算机视觉权威学者张磊在微软二十年间主导了Windows人脸检测与多模态数据奠基项目,培养出黄峥、朱珑等行业领军者。2025年他携DINO团队创立视启未来,获近亿元天使轮融资,聚焦具身智能世界模型。