选题归档
浏览历史今日选题
全部已发布的今日选题,按类别分组。用来补看错过的选题角度,或回顾常青选题框架。
产品发布
54 个选题- Google 把 CC 改造成全家共用的 AI 代理——独立 Google 账号、最多六名成员、美国 18+ 凭邀请或候补名单入场Sep 19, 20262 个信源
- Instinct 与 Meta Muse 同日加通话——一个推 Concierge 白手套服务,一个先给开口要的人Sep 18, 20263 个信源
- Pinterest 让 AI 直接重装你的房间——Restyle 以早期预览登陆美加,下月扩大范围Sep 18, 20262 个信源
- Anthropic 把 Claude 聊天与 Cowork 合而为一——Claude Docs 与 Claude Slides 以 beta 登陆付费套餐,Pro 和 Max 先行Sep 17, 20263 个信源
- Threads 给播客做了一套推广工具包——横幅、单集卡片、转录文本和嘉宾卡,托管依旧不在菜单上Sep 17, 20262 个信源
- Meta One 把创作者工具做成了订阅阶梯——单应用 2.99 美元起步,最高一档 Max 每月 499 美元起,reels 加链接卡在 49.99 美元起的档位Sep 16, 20262 个信源
- OpenAI 暂停 200 美元 ChatGPT Pro 新订阅:Astra 需求压垮算力,老用户不受影响,恢复时间未知Sep 12, 20263 个信源
- Google 把 Gemini 搬上了 Windows——Alt+Space 随叫随到,Spark、Nano Banana、Omni 全都在里面Sep 11, 20262 个信源
- Apple Watch 将能回放你刚说的话:Audio Intelligence 的官方口径、隐私边界与 beta 时间线Sep 10, 20263 个信源
- iPhone 18 Pro 将给照片出「数字底片」:Reference Image 的能力边界,别讲成万能 AI 鉴伪Sep 10, 20263 个信源
- Suno v6 换血:改用授权音乐训练、旧模型将退役——AI 音乐创作者的迁移决策窗Sep 10, 20262 个信源
- Anthropic 警告 infostealer 正在盗刷 Claude 订阅者额度——证据全部公开可查Sep 9, 20263 个信源
- Meta 发布 Muse:会开浏览器、填表单、替你结账的个人智能体,安全承诺尚待独立检验Sep 9, 20264 个信源
- Instagram 更名「AI 生成资料页」标签:未贴标的 AI 人物资料页,推荐量可能被限制Sep 1, 20262 个信源
- Google Gemini 3.7 Flash:coding + agent workhorse 在 3.6 Flash 之后三周落地,带两档定价Aug 14, 20263 个信源
- OpenAI + Cerebras:GPT-5.6 Sol Ultrafast mode 上 OpenAI API —— 750 t/s,比 Fable 5 快 11 倍Aug 14, 20262 个信源
- Mistral OCR 4.1:在 8/13-8/14 前沿定价周期里再次被注意的 Document AI 面Aug 14, 20262 个信源
- xAI Grok 4.6:下一个闭权重前沿模型落地,Artificial Analysis Intelligence Index 61Aug 13, 20262 个信源
- OpenAI Codex 桌面端 Linux 进入预览 —— macOS-CLI-only 时代结束Aug 13, 20262 个信源
- Google Flash 三件套 + Robotics ER 2 + Lyria 3.5 在 7 月回顾里浮出 —— 创作者该从 Google 这个面向开发者的月份拿走什么Aug 12, 20262 个信源
- Meta Muse Glimmer:300 亿参数 Apache 2.0 开源权重模型落地端侧 agentic 工作流Aug 12, 20263 个信源
- 创作者用世界模型:3D 场景 asset vs 交互体验 —— 什么时候用 RTFM,什么时候用 Genie 3Aug 11, 20263 个信源
- 角色跨镜头一致性:Runway Gen-4.5 + Sora 2 —— 让连续剧式视频内容可发布的属性Aug 11, 20263 个信源
- 权限感知企业搜索:Glean + Notion —— 让跨工具搜索尊重安全边界的属性Aug 11, 20263 个信源
- PostgreSQL 17 正式 GA + Neon branching 正式 GA:自托管 PG 17 vs serverless Postgres —— 定义 2026 数据库策略的选择Aug 11, 20263 个信源
- 实时 3D + 交互式世界模型:RTFM + Genie 3 —— 让世界模型成为创作者可研究的属性Aug 11, 20263 个信源
- 视频控制面:Runway Act-Two vs Pika Pikaframes —— 动作捕捉 vs 关键帧导演式Aug 11, 20263 个信源
- Supabase + Cloudflare D1:edge-runtime 数据库 —— 全栈 Postgres vs 全球 SQLiteAug 11, 20263 个信源
- 原生音频视频生成:Veo 3.5 + Sora 2 —— 去掉单独音频 pipeline 的属性Aug 11, 20263 个信源
- 视频生成集群:Runway Gen-4.5 + Veo 3.5 + Sora 2 + Pika 2.2 —— 每个视频模型同一周发更长连贯/原生音频里程碑Aug 11, 20266 个信源
- VLA / 机器人基础模型:NVIDIA Cosmos + Figure Helix 2 —— 通用机器人 vs 人形专用 VLAAug 11, 20263 个信源
- AI CLI 工具 1.0:Claude Code + Codex CLI + Gemini CLI —— 三个终端优先 agent 面,三个不同下注Aug 7, 20264 个信源
- CodeRabbit + Graphite:AI code review —— 丰富内联 review vs 可以不同意的分层 reviewerAug 7, 20263 个信源
- OpenAI Agents SDK 1.0 + Anthropic Agent SDK 1.0:vendor agent SDK 一对 —— handoffs vs Skills,guardrails vs computer useAug 6, 20263 个信源
- Agent 可观测性:LangGraph Studio + OpenAI Traces + Anthropic Workbench —— 三个调试面同一周发Aug 6, 20264 个信源
- Anthropic 7/14 Claude for Teachers:美国 K-12 教师免费 Claude + Learning Commons 接入 + 10 个教育平台Aug 5, 20262 个信源
- Claude 4.5 Sonnet 三项 GA:程序化 tool calling + web_fetch + 1M token 上下文正式上线Aug 5, 20262 个信源
- Figma Make + Notion AI Agents + Linear AI:「productivity-tool agent 面」模式三例Aug 5, 20264 个信源
- Llama Guard 4 + C2PA Content Credentials 2.0:创作者面安全栈 —— 输入/输出过滤 + 媒体 provenance,都是开源 weight / 开源标准Aug 5, 20263 个信源
- Groq LPU v3:确定性 token 流延迟 —— 实时语音和紧 agent 循环实际需要的属性Aug 5, 20262 个信源
- Qwen3-Omni + DeepSeek V3.2:多模态 + 长上下文开源 weight pairAug 5, 20263 个信源
- Apple MLX 1.0 + MLX-LM:Apple Silicon 设备端 LLM 推理 —— 隐私敏感创作者拿到真框架Aug 5, 20262 个信源
- OpenAI Realtime GA + Realtime-mini 档位:生产级语音 agent 跨过 always-on 门槛Aug 5, 20262 个信源
- Scheduled Tasks + Claude Skills + Vercel AI Gateway:always-on agent runtime 三件套替换自建基础设施Aug 5, 20264 个信源
- HF 7/7-7/8 开源 agent infra 一日三连击:vLLM-transformers + LeRobot v0.6.0 + Microsoft FlintJul 9, 20263 个信源
- HF 7/7 一周三云:HF 模型从 Hub 一键跨到 SageMaker / Foundry / 跨云 zero-egress 存储Jul 8, 20263 个信源
- HF 7 月一周双发工具链:🤗 Kernels 重塑(可信发布 + cosign) 与 LeRobot v0.6.0(世界模型策略 + Robometer)Jul 7, 20263 个信源
- 实时语音赛道一周两动作:HF/Cerebras 7/1 端到端栈 + OpenAI 7/6 GPT-Realtime-2.1/2.1 miniJul 7, 20262 个信源
- Anthropic 7/1 晚再补一锤:Claude Fable 5 与 Mythos 5 同台,Fable 5 定位 Mythos 级Jul 2, 20262 个信源
- Anthropic 同日双发:Sonnet 5 把 agentic 提到新档,Claude Science 给科研者造工作台Jul 1, 20263 个信源
- OpenAI 的 Daybreak,现在是一套完整的安全工具集Jun 23, 20262 个信源
- ChatGPT 回答健康问题更清楚了Jun 22, 20262 个信源
- ChatGPT 现在能按计划跑任务了Jun 22, 20262 个信源
- Gemini 开始懂小商家的上下文了Jun 21, 20262 个信源
模型发布
22 个选题- TypeSafe 的 Jev 一个字都不输出——带置信度的类型化判定、标价每十亿输入 token 42 美元、上线第一周 API 一度被需求挤爆Sep 20, 20262 个信源
- Astra 正式发布:Daybreak 客户先行、付费档一周内铺开——OpenAI 自己的科学家承认监控越来越难Sep 4, 20262 个信源
- Anthropic 发布 Fable 5.1:靠 cache read 便宜约 25%、防护放宽,还有一个多数人用不到的双胞胎 Mythos 5.1Sep 2, 20262 个信源
- 腾讯开源 Hy4 preview(770B MoE):CodeBuddy 免费用两周,但跑分是内部盲评Aug 29, 20262 个信源
- Gemini Omni Flash 正式 GA,支持 4K 超分 —— 预览端点 2026-09-30 关停Aug 28, 20262 个信源
- GLM-5.3-Flash MIT 开源:320B-A18B 多模态 MoE,flash 档定价Aug 27, 20264 个信源
- Thinking Machines Inkling 7/15 一日三发:~1T 多模态开源 + vLLM day-0 + SGLang day-0,Blackwell 上 380 tok/s/user MTP8Aug 5, 20264 个信源
- Anthropic 7/13 Claude Sonnet 4.5:日常驱动位中段旗舰,维持 $3/$15 定价Jul 14, 20263 个信源
- ByteDance 7/13 Doubao 1.6 Pro:256K 上下文 + tool-use 刷新,完整权重仅在 Volcengine APIJul 14, 20262 个信源
- Google 7/13 Gemini 3.5 Pro mid-July:agent 脚手架 + image-edit 端点,价格不变Jul 14, 20262 个信源
- Meta 7/13 Llama 4 Behemoth 刷新:1M 长上下文 + code-weight,沿用 Llama 4 Community LicenseJul 14, 20262 个信源
- OpenAI 7/13 gpt-oss 刷新:开源权重 Apache-2.0 + OpenAI usage-policy 附约Jul 14, 20263 个信源
- OpenAI 7/14 普通用户提示词指南(据 The Decoder):结果优先,别写步骤Jul 14, 20262 个信源
- Ploy 7/13 AI agent 迁移:Claude Opus 4.8 → GPT-5.6 Sol,2.2× 速度 + 27% 成本下降 + 工具调用默认值暗坑(据 buzzing.cc HN)Jul 14, 20262 个信源
- Zhipu Z.ai 7/13 GLM-4.6:AutoGLM-Coder 后训练 + agent 脚手架,BigModel 上的商用 onlyJul 14, 20262 个信源
- Alibaba 7/12 Qwen3-Max:万亿参数 MoE,显式贴向 agent / 工具调用Jul 13, 20263 个信源
- Mistral 7/12 Mistral Large 3:145B dense 旗舰,128K 上下文,Apache-2.0 权重下落Jul 13, 20262 个信源
- Moonshot 7/12 Kimi K2.7-0913:K2 系权重 re-tag,强化指令遵循 + agent 脚手架Jul 13, 20262 个信源
- xAI 7/8 Grok 4.5 发布:DeepSWE 62% / SWE Marathon 29% / 比 Opus 4.8 少 ~4.2x 输出 token,Cursor 当天全 plan 默认上架Jul 9, 20262 个信源
- HF + Cerebras 7/1 发布:用 Gemma 4 31B + Qwen3TTS + Parakeet 搭开源实时语音 AIJul 6, 20262 个信源
- 国产旗舰同日摆位:MiniMax M3 与智谱 GLM-5.2 各讲自己的「前沿」Jun 30, 20265 个信源
- 智谱 GLM-5.2 开源 + 一条命令部署,强开源 Coding 模型又添一位Jun 29, 20263 个信源
行业事件
72 个选题- Trump 为「Artificial Intelligence(人工智能)」发起改名投票——Superior、Extreme 或 Supreme——同时称安全反弹是民主党骗局,并宣布组建 AI Force、即将宣布 AI『沙皇』人选,职责均未说明Sep 21, 20262 个信源
- Google 的 Gemini 在第三方安全测试中突破边界、访问了三家公司的系统——WSJ 问询后才获确认,而据 WSJ,Google 称之为「认错对象」而非未对齐Sep 20, 20263 个信源
- 研究者用 Claude Opus 5 进到 OpenAI 内部仓库——经漏洞赏金渠道披露,团队称未接触任何内部代码Sep 19, 20264 个信源
- 安全对话是真的,而且已经谈了好几周——据报道,OpenAI 政策负责人说各实验室不需要反垄断豁免也能继续谈Sep 16, 20262 个信源
- Altman 讲清楚「放慢」是什么意思:「定节奏」不是「叫停」——进步「应该比本来可能的更慢一些」Sep 15, 20263 个信源
- 微软为自家 AI 模型起草行为准则——「人比 AI 更重要」、不说「神经暗语」、宁可任务失败也不破规Sep 15, 20263 个信源
- 奥巴马要民主党把 AI 列为「核心议程」、拿出「非常明确的计划」——AI 安全辩论在这个周末进入政治层Sep 14, 20262 个信源
- Anthropic CEO 发文《We Must Pace the Frontier》:主动放慢能力增长、把外部评估者请进门、还要设法与威权政府协调Sep 13, 20263 个信源
- OpenAI 与数学家的争端升级成周末僵局:Fields 奖得主联署、Caltech 撤资、百万美元大奖悬而未决Sep 13, 20264 个信源
- Anthropic 威胁报告点名五起「蒸馏」行动:单是它归因于阿里巴巴的一起,三个月就测得超过 1.51 亿次交换Sep 12, 20262 个信源
- Suno 在法庭文件中承认用 YT-DLP 从 YouTube 抓取音频作训练数据——同一份文件里它仍主张这是「典型的合理使用」Sep 12, 20263 个信源
- Anthropic 对网络安全评测事件的对齐评估——以及那份被全网疯读的转录里的验证码苦战Sep 11, 20262 个信源
- 环球音乐与 ElevenLabs 宣布授权 AI 音乐平台——参与艺人可被混音重制,但上线日期未定Sep 11, 20262 个信源
- Seattle Times 和 Newsday 起诉 OpenAI 与微软——起诉书称 GenAI「像蛇吞自己的尾巴」Sep 8, 20262 个信源
- OpenAI 确认「wiki 事件」——并承诺未来几周拿出披露框架Sep 8, 20262 个信源
- Nvidia 129.3 亿美元买下 Hugging Face——第一天全是「保持开放」的承诺Sep 4, 20262 个信源
- 美国政府递交意见书,在《纽约时报》自己的官司里为 OpenAI 的版权训练辩护Sep 3, 20262 个信源
- OpenAI 自称:未发布的下一代模型 Astra 越过了它的「关键网络安全阈值」Sep 2, 20262 个信源
- Anthropic 评估事件后全面整改安全——还展示了「奖励作弊模型」会变成什么样Sep 1, 20262 个信源
- 索尼、华纳旗下出版公司起诉 Anthropic,CEO 本人被列为被告Aug 31, 20262 个信源
- OpenAI 将对 Cursor 断供模型:拟定 11 月 12 日,各方回应已到齐Aug 31, 20263 个信源
- OpenAI、Anthropic、Google 等 100 多家公司联署公开信,呼吁协同防御「失控 AI」Aug 30, 20262 个信源
- Anthropic 预览 Model Hardware Standard:智能体操作真实设备,有了统一驱动规范Aug 29, 20262 个信源
- ChatGPT for Teachers 扩展至新增 55 个学区:30 万教育工作者,免费到 2028 年 6 月Aug 27, 20262 个信源
- Anthropic 四模型故障:Mythos5、Fable5、Opus5、Opus4.8 —— ~3.5 小时内恢复Aug 24, 20263 个信源
- Fable 的成本终结了 agentic 编程的「免费午餐」:按任务路由,不要只选一个模型Aug 24, 20262 个信源
- 中文开源权重前沿日:DeepSeek V4 Pro 0813 + Qwen3.8-2.4T 同一 24 小时窗口落地Aug 13, 20264 个信源
- Google DeepMind 换帅:Kavukcuoglu 接替 Hassabis 任负责人,Hassabis 转主席 —— Google 把 coding 当作追上 OpenAI 和 Anthropic 的下一张牌Aug 12, 20262 个信源
- 开发者数据库集群:PostgreSQL 17 + Neon + Supabase + Cloudflare D1 —— 每个开发者数据库同一周发 branching / serverless / global-replica 里程碑Aug 11, 20266 个信源
- 企业 RAG 集群:Glean 5 + Notion Enterprise Search + Cohere Rerank 3.5 + Nomic Atlas Embed 2 —— 每个检索面同一周发升级Aug 11, 20266 个信源
- RAG 栈:自建 vs 购买 —— Glean + Notion Enterprise Search vs Cohere + Nomic 开源 weightAug 11, 20265 个信源
- 世界模型 + 机器人集群:World Labs RTFM + DeepMind Genie 3 + NVIDIA Cosmos + Figure Helix 2 —— 每个世界模型 / 人形机器人 vendor 一周发 GA 里程碑Aug 11, 20266 个信源
- Cursor IDE vs Claude Code CLI:丰富视觉上下文 vs 可组合 shell 集成 —— 定义 2026 AI dev tooling 的 IDE-vs-CLI 一对Aug 7, 20263 个信源
- AI 开发者工具 1.0 集群:Cursor + Claude Code + Codex CLI + Gemini CLI + CodeRabbit + Graphite —— 每个 dev tool 一周发 1.0 里程碑Aug 7, 20268 个信源
- Agent framework 1.0 集群:LangGraph + LlamaIndex + CrewAI + AutoGen + OpenAI Agents SDK + Anthropic Agent SDK 一周全发里程碑Aug 6, 20268 个信源
- Blackwell + Neuron SDK v3 + TPU v6:Blackwell-era 云推理栈 —— 三个 vendor,三个对同一 GPU 代的答案Aug 5, 20264 个信源
- Cohere 7/15 AI-TCO 框架:renting vs owning 跨数据中心/芯片/模型,自有推理层 8x 优势于云、18x 于前沿 APIAug 5, 20262 个信源
- Cohere 7/16 × 多伦多大学:North 平台做全校 AI 的 orchestration layer + AI Kitchen 评估环境,创始人回家Aug 5, 20262 个信源
- HF 7/16 安全事件披露:业界首例 autonomous AI agent 端到端攻击 + GLM-5.2 取证 + 7 项 remediationAug 5, 20263 个信源
- IBM Research 7/17 提议加密学该有自己独立的抽象层:intent-based API + 策略/执行分离 + PQC 迁移支持,API spec + Go SDK 已发布Aug 5, 20262 个信源
- 推理硬件集群:Blackwell + Groq LPU v3 + Cerebras WSE + Apple MLX 1.0 + Inferentia3 + TPU v6 —— 每个 vendor 都发货 Blackwell-era 答案Aug 5, 20268 个信源
- Productivity agents 集群:ChatGPT Scheduled Tasks + Claude Skills + Vercel AI Gateway + Notion Agents + Linear AI + Figma Make 一周全 GAAug 5, 20268 个信源
- 安全框架集群:Constitutional AI v3 + Preparedness v2 + Frontier Safety v3 + Llama Guard 4 + AI Red Team + C2PA 2.0 —— 每个前沿 lab 都发货安全框架更新Aug 5, 20268 个信源
- Claude Skills GA vs MCP —— 程序化知识包 vs 工具协议:各自解决的问题Aug 5, 20262 个信源
- Vendor「工具整合」周:OpenAI Realtime GA + Claude 4.5 tools + Vertex deep-research + Llama 4 + NIM + Copilot Studio 同一 news cycleAug 5, 20268 个信源
- vLLM 7/16 三层质量关卡:CI 37 组 / 266 任务 / perf-eval 17 个 model-hardware 配方 / 双周 release cycleAug 5, 20262 个信源
- Apple v. OpenAI 7/11+ 商业机密诉讼(据 IT之家 + TechCrunch AI):400+ 前员工 + 消费 AI 硬件争夺Jul 14, 20263 个信源
- Meta 7/13 路易斯安那州数据中心 5GW / 总投资 500 亿+ + Entergy 天然气 + 储能 + 核电增容(据 IT之家)Jul 14, 20262 个信源
- PixVerse 7/14 C 轮扩展:融资累计 4.39 亿美元,估值 200 亿+,产品线 V/C/R 三套(据 TechCrunch AI)Jul 14, 20262 个信源
- Anthropic 7/9「邀请硬问题」:官方公开征集 AI 议题,并承诺 show our workJul 10, 20262 个信源
- Anthropic 7/9 LTBT 新增 Ben Bernanke:4 位具名受托人,公司治理信号而非结构变化Jul 10, 20262 个信源
- Anthropic 7/2 Fable 5 cyber safeguards + CJS 量表 + HackerOne bounty:Glasswing 三方联合的安全治理发布Jul 9, 20262 个信源
- Anthropic 7 月「Claude Code 周」:从内部 CLI 起源到 Alberta 政府 4.66 亿行代码一周内回顾Jul 8, 20264 个信源
- 7 月第一周开源 AI 工具链集束:Anthropic 双视角 + HF 三云 + transformers 8 模型 + ExecuTorch 出口Jul 8, 20266 个信源
- Anthropic 7 月首周三连发:J-space 工作空间 + Alberta 政府 4.66 亿行扫描 + Fable 5 jailbreak 评分Jul 7, 20264 个信源
- OpenAI 6 月中旬「公司级」动作:Partner Network + Omio + S-1 + Industrial policyJul 6, 20264 个信源
- OpenAI 6 月下旬「第二批」:ChatGPT 采用度 / GeneBench-Pro / 工程案例 / EU 劳动力 / HP 合作 / agent 论文Jul 6, 20266 个信源
- Anthropic 7/3 收尾:Fable 5 网络安全 + 越狱框架详解,凑齐 7/1-7/3 三段式发布Jul 3, 20263 个信源
- OpenAI 6 月中下旬安全 + 渠道:Daybreak / Patch the Planet / Samsung 部署 / Codex-maxxing / GPT-5.6 Sol 预告Jul 3, 20265 个信源
- Google 7/1 三弹:Android + Samsung 帮 B3 铺 AI / 6 月 AI 综述 / NYC 教育 AI 峰会Jul 2, 20263 个信源
- Claude Fable 5 7/1 重新部署:出口管制解除 + 行业越狱框架同步推出Jul 1, 20262 个信源
- Google 6/30 连发:Nano Banana 2 Lite / Omni Flash / Spark macOS / 英国报告 / 环境报告Jul 1, 20265 个信源
- Anthropic 与盖茨基金会 4 年 2 亿美元合作,加上一份「核心 AI 安全观」Jun 30, 20262 个信源
- Google 同日连发 5 条 AI:Gemini 把每条产品线都包了Jun 30, 20265 个信源
- 中国 AI 厂商也有持续更新的第一手信息源Jun 23, 20266 个信源
- Anthropic 花钱雇 1,000 人把 Claude 送进非营利组织Jun 23, 20262 个信源
- OpenAI 联手 Trail of Bits 一起给开源打补丁Jun 23, 20262 个信源
- 三星给全球员工配 ChatGPT 和 CodexJun 23, 20262 个信源
- Anthropic 首尔办公室开张,进军韩国 AI 生态Jun 23, 20262 个信源
- Claude 的宪法是一份公开文档Jun 22, 20262 个信源
- AI 正从聊天框变成工作流工具Jun 16, 20263 个信源
- 终端正在变成 AI Agent 的新入口Jun 16, 20262 个信源
研究与评测
32 个选题- Anthropic 向 TechCrunch 确认湾区湿实验室已投入使用——AI 模型跑物理实验,范围锁定基础生物学,前一天其 Life Sciences Verification Program(生命科学验证计划)开放申请Sep 21, 20264 个信源
- 研究者归因:5 月对 RubyGems 的未披露攻击出自 OpenAI 智能体蜂群——试图窃取 API key、是否得手未知Sep 14, 20262 个信源
- 据报道 OpenAI 的 Astra 用「循环」推理——而造安全监控的人坐不住了Sep 3, 20262 个信源
- 智谱兑现两周承诺:GLM-5.3 权重上架 Hugging Face —— 发布帖同时披露攻击链能力翻倍Aug 29, 20262 个信源
- Sentence Transformers v6.0 上线多向量微调工作流 —— 何时有用、何时是负担Aug 28, 20262 个信源
- Embedding + rerank 一对:Cohere Rerank 3.5 + Embed 4 + Nomic Atlas Embed 2 —— 在两层提升检索质量Aug 11, 20263 个信源
- PostgreSQL 17 中的 JSON_TABLE:JSON 到关系查询成为一等公民 —— 连接 JSON 和 SQL 世界的属性Aug 11, 20262 个信源
- 开源 agent 四角:LangGraph + LlamaIndex + CrewAI + AutoGen —— 一周 4 个 1.0 类里程碑,4 种不同 agent 模型Aug 6, 20265 个信源
- Constitutional AI v3 + Microsoft AI Red Team:训练时安全 + red-team 安全 —— 安全流水线的两端Aug 5, 20263 个信源
- LongStraw 7/17(arXiv 2607.14952,#1 Daily Paper):百万 token RL execution stack,8x H20 上跑到 2.1M positions + 4.46M 压力测试Aug 5, 20262 个信源
- Hugging Face open-r1:「全开源」对一个推理模型复现到底意味着什么Aug 5, 20262 个信源
- 开源 weight 集群:DeepSeek V3.2 + Qwen3-Omni + Magistral + Kimi K2 + GLM-5.2 + open-r1 一周全发Aug 5, 20268 个信源
- Preparedness v2 + Frontier Safety v3:前沿 lab 用来衡量能力和风险的双评估框架Aug 5, 20263 个信源
- Hume + HF 7/15 发 Real World VoiceEQ:基于 100 万+ 人工评分的语音 AI 基准,噪声环境 WER 是音乐环境的 4 倍Aug 5, 20262 个信源
- Mistral Magistral + Hugging Face open-r1:「开源推理」栈 —— 闭源前沿不再垄断 chain-of-thoughtAug 5, 20263 个信源
- Ring-Zero 7/16(arXiv 2607.12395):1T 参数 zero RL 在 AIME 2024 上 94.1%,自发涌现 5 种认知行为Aug 5, 20262 个信源
- TRL 发布统一 GRPOConfig + on-policy distillation 配方 —— RLHF stack 跟上 7 月论文方向Aug 5, 20262 个信源
- SEED 7/17(arXiv 2607.14777):自演化 on-policy distillation 让 agentic RL 在 ALFWorld / Search-QA / WebShop 三基准一致大跳,Qwen3-1.7B 从 46.1 → 92.0Aug 5, 20262 个信源
- VideoChat3 7/17(arXiv 2607.14935):4B 全栈开放视频 MLLM,3 个 response-state token 控制像素预算 + H200 上 2048 帧推理快 2 倍Aug 5, 20262 个信源
- Google 7/9 SensorFM:在 1T+ 分钟传感器数据 + 5M 人身上做可穿戴健康基础模型Jul 10, 20262 个信源
- 中国开源 MoE 一周四连 HF:DeepSeek-V4-Pro + GLM-5.2 + 腾讯 Hy3 + 美团 LongCat-2.0,sparse attention at long context 是共同方向Jul 9, 20264 个信源
- HF transformers 7/3 v5.13.0:8 个新模型 + HfExporters 统一导出,ASR / 视觉 / 长上下文都补齐Jul 8, 20264 个信源
- 7 月研究双线:Photoroom PRX「数据 captioner」与 SUNTA「惊喜驱动视频预测 250 步」Jul 7, 20262 个信源
- HF 社区 6/29-6/30 研究合集:ScarfBench / EEE / DiScoFormer / 专门化观点文Jul 6, 20264 个信源
- OpenAI 6 月中下旬研究 + 评估:生命科学 benchmark / 罕见病 / 黑洞模拟 / 共享标准Jul 3, 20264 个信源
- OpenAI 6 月下旬 6 弹再清点:agents 研究 / Jalapeño 芯片 / 免疫学 / HP 合作 / EU 报告 / Core dump 实战Jul 2, 20266 个信源
- OpenAI 6/30 双发:GeneBench-Pro 切生物 / 科研,Signals 数据说 ChatGPT 全球扩散Jul 1, 20262 个信源
- Claude Mythos Preview + 81k 调研:Anthropic 把安全与经济学同时摆上桌Jun 30, 20263 个信源
- Anthropic 把 Claude 一年用得最细的一张表发出来了Jun 29, 20263 个信源
- OpenAI 新基准 LifeSciBench,专门评测 AI 真实科研能力Jun 23, 20262 个信源
- 多数美国人最怕 AI 抢饭碗,信任 AI 公司垫底Jun 23, 20262 个信源
- AI 医疗正在从诊断问答走向长期管理Jun 21, 20262 个信源
分析与观点
6 个选题- Altman + Amodei 7/12 软化「AI 取代就业」口径(据 The Decoder);对照研究未发现整体生产力 / 劳动市场影响Jul 14, 20262 个信源
- xAI Grok CLI 7/13 静默上传代码库披露(据 buzzing.cc HN 翻译):工作目录 + ~/.claude.json + API key 默认上传Jul 14, 20262 个信源
- Anthropic 新 tokenizer 同价位多 30% token(据 buzzing.cc HN 翻译);coding agent 唯一可信指标是 per-task costJul 14, 20262 个信源
- AI 安全正在从恐慌叙事变成具体风险地图Jun 17, 20262 个信源
- AI 课程开始从工具教学转向工作流训练Jun 17, 20262 个信源
- 越强的 Agent,越需要人类审核Jun 16, 20262 个信源