数据约束下混合预训练的缩放定律
本文研究了在目标数据稀缺时,如何将目标数据与通用数据混合进行预训练。通过超过2000次语言模型训练实验,发现重复使用目标数据15-20次仍可提升性能,并提出了考虑重复效应的混合缩放定律,为数据受限下的预训练提供了实用的混合配置建议。

本文研究了在目标数据稀缺时,如何将目标数据与通用数据混合进行预训练。通过超过2000次语言模型训练实验,发现重复使用目标数据15-20次仍可提升性能,并提出了考虑重复效应的混合缩放定律,为数据受限下的预训练提供了实用的混合配置建议。

亚马逊云科技在 Bedrock AgentCore 中扩展了 Policy 功能,新增基于时间的约束,并升级 Policy Authoring 工具,可将自然语言策略文档自动转换为 Dogwood 形式规范,支持时间约束、轨迹约束、Guardrails 调用及工具参数限制,帮助团队在代理系统中实施治理控制。
微软研究院发布Skala 1.1,这是其深度学习交换关联泛函的更新版本,训练数据量增加2.5倍,在热化学、反应动力学和分子结构预测等关键模拟任务上精度显著提升。Skala现已集成到CP2K,并正在整合到Psi4、FHI-aims、ORCA和VASP中,使更多计算化学社区能够使用。同时,微软推出了实时基准测试,以跟踪Skala后续版本的性能,推动计算化学向预测性和可及性发展。


Mistral 发布 Agentic Search,一种多步骤检索工具,使 AI 模型能搜索、导航、阅读并验证复杂文档中的信息。相比传统 RAG,它在 FinanceBench 上准确率从 26.7% 提升至 86%,在 OfficeQA Pro 上提升 45.6 个百分点,同时降低延迟和 token 消耗。该工具通过 Mistral Search Toolkit 提供,支持本地或云端部署,无需微调。

Liquid AI 发布 LFM2.5-DSpark 投机解码草案模型,针对 LFM2.5 系列实现最高 3.2 倍推理加速。该方案结合 DFlash 风格并行主干、马尔可夫链顺序头和置信度调度验证器,在 H100 上平均提速 2.67 倍,在 M4 Max MacBook 上平均提速 2.27 倍,并将函数调用延迟降低 57%。草案模型约 3 亿参数,已开源并支持 llama.cpp 和 SGLang。


AWS 专业服务团队构建了一个基于 Amazon Bedrock AgentCore 的多智能体框架,用于自动化企业云迁移。该框架包含四个智能体,分别负责自动发现、基础设施即代码生成、组合治理和运维,将 IaC 开发时间从每应用 3-4 周缩短至几分钟。

Liquid Death 与 Jason Kelce 合作推出幽默广告,提议用尿液冷却 AI 数据中心。专家指出,虽然不能直接用尿液,但回收水(经处理的废水)已在数据中心冷却中广泛应用,可减少饮用水消耗。目前弗吉尼亚州劳登县的数据中心仅 43% 用水来自回收水,基础设施不足是主要挑战。行业正推动投资和税收优惠以扩大回收水基础设施。
该论文提出中东文化敏感度评分(MECSS),将萨义德的七种东方主义操作转化为可量化维度,并引入“萨义德洗白”概念。通过对GPT-4和Falcon3-7B-Instruct的280次对话(1120次交流)分析,发现两者均系统性再现东方主义模式,且Falcon3-7B-Instruct得分更高,表明区域训练并不能自动减少偏见。
FLUX Upscale 是 BFL 推出的独立工具和端点,可将任意视频重新生成至最高原生4K分辨率。它原生理解 FLUX 3 输出,修复通用放大工具遗漏的瑕疵(如模糊面部、纹理网格伪影)。提供 Precise(4步,$0.07/百万像素/秒)和 Creative(8步,$0.10/百万像素/秒)两种模式,支持1.5x、2x、3x放大倍数,适用于广播、广告和巨幕等需要高分辨率的场景。


本文认为,尽管超级智能AI有望加速医学进步,但治愈癌症面临数据瓶颈和生物学复杂性等根本性挑战。作者指出,AI在蛋白质结构预测等分子层面问题上有突破,但癌症涉及多系统相互作用,需要真实世界数据和时间,无法靠算力速成。文章主张,AI公司需正视承诺与现实的差距,才能赢得公众信任。


在世界机器人大会上,优必选展示了覆盖工业、商业、家庭三大场景的人形机器人实景应用,包括Walker C1、Cruzr系列和超仿生机器人U1。公司强调其自研的Thinker具身大脑体系,包含基座模型、世界模型和VLA模型,并联合英伟达实现端侧部署。优必选副总裁焦继超认为,行业竞争已从参数转向真实场景落地能力,生态构建成为关键。


a16z 合伙人 Gabriel Vasquez 表示,其应用基金投资中 44% 有国际创始人,并推出 Borderless Founder 网络支持移民和国际创始人。他认为,AI 使全球企业更愿意购买第三方解决方案,国际创始人可凭借本土市场与硅谷的双重优势,在 AI 领域获得更多机会。
谷歌即将在Google应用中推出Discover信息流定制功能,用户可通过聊天式界面描述偏好,AI将自动调整并记住这些设置。该功能将在未来几天内上线,入口位于Discover信息流的三点菜单中。此外,谷歌还更新了Google News音频简报的个性化选项,并允许发布商在网站上放置“首选来源”按钮,方便读者快速添加。


Databricks 展示了如何将传统数据仓库中的存储过程、游标、临时表和事务逻辑直接翻译为 Databricks SQL 脚本,无需重写为 Python 或 Spark。新功能如原生游标支持、BEGIN ATOMIC 事务和 Unity Catalog 治理,使迁移时间缩短 50-75%,并保留原有业务逻辑,让 SQL 团队继续维护。
半导体工程报道,为满足AI工作负载的带宽需求,2.5D和3D封装成为趋势,但中介层面临热机械失效和电迁移风险。研究人员利用深度学习模型预测翘曲,并优化铜晶粒结构以增强抗电迁移能力,为先进封装可靠性提供新思路。

AWS推出向量搜索解决方案,将向量能力集成到现有数据库和存储服务中,无需迁移数据。该方案覆盖六种服务,提供决策模型,支持RAG、语义搜索、混合搜索等智能体AI用例,并强调在数据所在处添加向量,以降低成本、提升性能。


阿里巴巴发布2027财年第一季度财报,CEO吴泳铭在分析师电话会上表示,预计下季度AI相关产品年化收入(ARR)将接近100亿美元。本季度AI相关产品ARR已突破495亿元人民币(73亿美元),未来阿里云EBITA利润率将逐季提升。
作者在播客中讨论AI如何改变软件开发,主张在编码代理时代,代码行数仍是衡量生产力的有效指标,因为人类认知能力成为新瓶颈。同时强调概念完整性在AI生成代码时更难维持,需要纪律约束。
Adobe 在 Firefly 平台正式推出三款 AI 音频工具:Generate Music 生成免版税音乐、Generate Speech 将脚本转为配音、Generate Sound Effects 为场景制作音效,均支持商用。同时,Firefly AI Assistant 提供每日免费生成次数,并新增 Google Gemini Omni Flash 模型,支持视频、音频、图像和文本输入。
谷歌推出“首选来源”按钮,允许读者在出版商网站上标记其为偏好来源,从而在搜索、Discover和Google News中更频繁展示,以缓解AI搜索带来的流量下降。该功能此前已应用于AI模式,现扩展至所有出版商。谷歌还计划让用户通过自然语言定制Discover feed和音频简报。