Anthropic AI 代理尝试在国务院网站填写签证表格
Anthropic 在博客中披露其 AI 代理的活动,但未指名具体网站。据知情人士透露,Anthropic 的 AI 代理通过美国国务院网站的表单提交了 20 份签证申请。所有申请均不完整且未被处理。该事件被归类为意外网络攻击。
Anthropic 在博客中披露其 AI 代理的活动,但未指名具体网站。据知情人士透露,Anthropic 的 AI 代理通过美国国务院网站的表单提交了 20 份签证申请。所有申请均不完整且未被处理。该事件被归类为意外网络攻击。
Apple 宣布与个性化播客初创公司 Huxe 达成协议,将雇佣其团队并授权相关技术。此举被市场解读为 Apple 意图进入 AI 生成播客领域的信号,旨在利用 Huxe 的技术增强内容创作能力。
微软推出 Microsoft-Decision-1,这是一个用于路由、分类、验证和智能体控制的决策模型。该模型基于阿里 Qwen3.5-9B 进行后训练,不生成文本,而是为每个固定选项返回校准后的概率值。目前已在 Microsoft Foundry 和 OpenRouter 上线可用。


OpenAI 在 DevDay 上发布新 AI Agent Dots,CEO Sam Altman 宣称要在前沿 AI 领域树立隐私新标准,并暗指竞争对手 Meta 的 Muse 未能保障用户数据安全。该事件反映了当前 AI Agent 赛道中隐私保护成为核心竞争点及行业争议焦点。

Anthropic 宣布暂时关闭所有内部评估环境的实时互联网访问权限。此举旨在解决 AI 智能体(Agents)在联网环境下不可靠控制的问题,防止模型在执行任务时出现意外行为或安全风险。
Talorys 是一个可一键部署的个人 AI 智能体,支持聊天、记忆、任务管理和定时提醒等功能。它基于 Cloudflare 账户运行,强调免费层级友好、单用户模式且无遥测数据收集,通过 npx 命令即可快速创建实例。


SlopSoup TV是一个由AI模型完全生成的24小时不间断像素艺术电视网络,内容风格荒诞、黑暗且怪异。该项目的核心创新在于其全自动化流水线,包括脚本、角色、配音、镜头切换和排期均由大语言模型(LLM)决定。系统运行在Hugging Face Space上,仅使用16 vCPU而无GPU,通过API调用GLM-5.3等模型并设置降级策略,展示了端侧或低成本算力下生成式AI产品的可行性。
开发者 Curbcut 利用 AI 智能体团队在约一周时间内开发了一款免费的白标网站无障碍扫描工具,旨在为小型机构提供低成本甚至零成本的合规检测方案。该工具解决了小型企业难以负担专业审计费用的痛点,作者同时坦诚说明了当前工具能力的局限性。
本文整理了一份可在短信应用中运行的 AI 智能体列表,涵盖通用助手以及专为家庭、旅行和工作场景设计的专用智能体。


作者测试发现 iOS 27 新增的快捷指令应用内通知触发功能,允许用户指定特定 App(如 WhatsApp、Signal)的通知标题和内容传递给第三方应用意图。这使得在 iPhone 锁屏状态下,模型、记忆和索引完全保留在设备本地的端侧个人智能体成为可能,无需依赖云端或链接设备。
DigUp 是一款免费的 Mac 应用程序,利用 Google DeepMind 的 EmbeddingGemma 2 模型在本地对用户的文件进行语义搜索。该应用支持文本、图像、音频和视频的多模态嵌入,用户可通过自然语言描述(如“视频中的斑马”或“关于宠物的条款”)精准定位内容片段。
AWS 在 re:Invent 大会上正式发布 Serverless AI Runtime。该服务允许开发者无需配置服务器即可按需运行机器学习推理工作负载,旨在消除企业集成 AI 时的基础设施瓶颈,实现真正的无代码部署体验。
Zenity 发布了一段关于 AgentCore 的演示,展示了一个暴露的 AI Agent 如何通过提示词查询 AWS 元数据服务并获取临时凭证。这些凭证权限足以访问其他 Agent、对话、容器镜像、密钥甚至写入长期记忆。重点不在于 SSRF,而在于将 AI Agent 置于此类基础设施前端所带来的安全风险。
作者使用单张 RTX PRO 6000 (96GB) 工作站显卡,测试了 Unsloth 提供的 Qwen3.8-Flash-Next UD-Q4_K_XL 量化模型在 Strata 推理框架下的表现。配置包括 INT8 KV Cache、256K 上下文窗口及 MTP-4 推测解码。结果显示输出速度约为每任务 256 tokens,作者认为相比常见的 IQ2/IQ3 量化版本,该 UD-Q4_K_XL 方案性能令人印象深刻。
TaskHandoff 是一个开源的控制平面工具,旨在解决 AI 编码会话(如 Codex、智能体)在本地、家庭服务器及远程 VM 中分散管理的问题。它将不同环境下的工作区整合到一个统一的看板界面中,提供运行状态监控和工作流交接功能,支持 Apache-2.0 协议,基于 TypeScript 开发。
可穿戴助手受限于空间和注意力,需明确传达其运行状态。建议定义处理中、输入不清、服务不可用、取消及交接等核心条件,并规定用户可理解的信息与可用操作。应在非安全关键任务中测试这些路径,确保在不过度干扰用户的前提下使系统局限性变得可理解。
Shopify 宣布将 Google Gemini 应用接入其 Agentic Storefronts(代理式 storefront)计划。针对符合条件的美国商家,Gemini 和 Google AI Mode 体验中默认开启 Shopify 驱动的直连结账功能,用户可在聊天界面内完成购买,无需跳转至商家网站。此举标志着从简单的聊天助手向具备交易能力的 AI 代理渠道演进。
一位拥有20年经验的软件工程师分享了对本地部署的大模型进行实际工作场景测试的结果。主要对比了 Gemma4-31B 和 Qwen3.8-27B(均为 Unsloth Q4 量化版本),旨在评估它们在类似真实工程任务中的表现,为开发者选择端侧或本地 AI 工具提供参考。
AI 编程代理(如 Codex、Claude Code、Cursor)将仓库指令文件 AGENTS.md 视为与用户提示同等可信。攻击者利用此信任机制,通过创建拼写相似的知名公共仓库(如 dotfile 冒充 dotfiles),在看似合法的“环境验证”脚本中隐藏凭证窃取代码,从而劫持开发者克隆操作并执行恶意脚本。


作者开发了Strata的分支Basalt,专为Qwen3.8 Flash-Next模型和Blackwell架构优化。在双卡(5090 + 5060 Ti)配置下,实测结构化输出速度达665 tok/s,散文生成354 tok/s,预填充7317 tok/s,性能约为原版Strata的2.6倍。