选题归档
浏览历史今日选题
全部已发布的今日选题,按类别分组。用来补看错过的选题角度,或回顾常青选题框架。
产品发布
19 个选题- Anthropic 7/14 Claude for Teachers:美国 K-12 教师免费 Claude + Learning Commons 接入 + 10 个教育平台Aug 5, 20262 个信源
- Claude 4.5 Sonnet 三项 GA:程序化 tool calling + web_fetch + 1M token 上下文正式上线Aug 5, 20262 个信源
- Figma Make + Notion AI Agents + Linear AI:「productivity-tool agent 面」模式三例Aug 5, 20264 个信源
- Llama Guard 4 + C2PA Content Credentials 2.0:创作者面安全栈 —— 输入/输出过滤 + 媒体 provenance,都是开源 weight / 开源标准Aug 5, 20263 个信源
- Groq LPU v3:确定性 token 流延迟 —— 实时语音和紧 agent 循环实际需要的属性Aug 5, 20262 个信源
- Qwen3-Omni + DeepSeek V3.2:多模态 + 长上下文开源 weight pairAug 5, 20263 个信源
- Apple MLX 1.0 + MLX-LM:Apple Silicon 设备端 LLM 推理 —— 隐私敏感创作者拿到真框架Aug 5, 20262 个信源
- OpenAI Realtime GA + Realtime-mini 档位:生产级语音 agent 跨过 always-on 门槛Aug 5, 20262 个信源
- Scheduled Tasks + Claude Skills + Vercel AI Gateway:always-on agent runtime 三件套替换自建基础设施Aug 5, 20264 个信源
- HF 7/7-7/8 开源 agent infra 一日三连击:vLLM-transformers + LeRobot v0.6.0 + Microsoft FlintJul 9, 20263 个信源
- HF 7/7 一周三云:HF 模型从 Hub 一键跨到 SageMaker / Foundry / 跨云 zero-egress 存储Jul 8, 20263 个信源
- HF 7 月一周双发工具链:🤗 Kernels 重塑(可信发布 + cosign) 与 LeRobot v0.6.0(世界模型策略 + Robometer)Jul 7, 20263 个信源
- 实时语音赛道一周两动作:HF/Cerebras 7/1 端到端栈 + OpenAI 7/6 GPT-Realtime-2.1/2.1 miniJul 7, 20262 个信源
- Anthropic 7/1 晚再补一锤:Claude Fable 5 与 Mythos 5 同台,Fable 5 定位 Mythos 级Jul 2, 20262 个信源
- Anthropic 同日双发:Sonnet 5 把 agentic 提到新档,Claude Science 给科研者造工作台Jul 1, 20263 个信源
- OpenAI 的 Daybreak,现在是一套完整的安全工具集Jun 23, 20262 个信源
- ChatGPT 回答健康问题更清楚了Jun 22, 20262 个信源
- ChatGPT 现在能按计划跑任务了Jun 22, 20262 个信源
- Gemini 开始懂小商家的上下文了Jun 21, 20262 个信源
模型发布
16 个选题- Thinking Machines Inkling 7/15 一日三发:~1T 多模态开源 + vLLM day-0 + SGLang day-0,Blackwell 上 380 tok/s/user MTP8Aug 5, 20264 个信源
- Anthropic 7/13 Claude Sonnet 4.5:日常驱动位中段旗舰,维持 $3/$15 定价Jul 14, 20263 个信源
- ByteDance 7/13 Doubao 1.6 Pro:256K 上下文 + tool-use 刷新,完整权重仅在 Volcengine APIJul 14, 20262 个信源
- Google 7/13 Gemini 3.5 Pro mid-July:agent 脚手架 + image-edit 端点,价格不变Jul 14, 20262 个信源
- Meta 7/13 Llama 4 Behemoth 刷新:1M 长上下文 + code-weight,沿用 Llama 4 Community LicenseJul 14, 20262 个信源
- OpenAI 7/13 gpt-oss 刷新:开源权重 Apache-2.0 + OpenAI usage-policy 附约Jul 14, 20263 个信源
- OpenAI 7/14 普通用户提示词指南(据 The Decoder):结果优先,别写步骤Jul 14, 20262 个信源
- Ploy 7/13 AI agent 迁移:Claude Opus 4.8 → GPT-5.6 Sol,2.2× 速度 + 27% 成本下降 + 工具调用默认值暗坑(据 buzzing.cc HN)Jul 14, 20262 个信源
- Zhipu Z.ai 7/13 GLM-4.6:AutoGLM-Coder 后训练 + agent 脚手架,BigModel 上的商用 onlyJul 14, 20262 个信源
- Alibaba 7/12 Qwen3-Max:万亿参数 MoE,显式贴向 agent / 工具调用Jul 13, 20263 个信源
- Mistral 7/12 Mistral Large 3:145B dense 旗舰,128K 上下文,Apache-2.0 权重下落Jul 13, 20262 个信源
- Moonshot 7/12 Kimi K2.7-0913:K2 系权重 re-tag,强化指令遵循 + agent 脚手架Jul 13, 20262 个信源
- xAI 7/8 Grok 4.5 发布:DeepSWE 62% / SWE Marathon 29% / 比 Opus 4.8 少 ~4.2x 输出 token,Cursor 当天全 plan 默认上架Jul 9, 20262 个信源
- HF + Cerebras 7/1 发布:用 Gemma 4 31B + Qwen3TTS + Parakeet 搭开源实时语音 AIJul 6, 20262 个信源
- 国产旗舰同日摆位:MiniMax M3 与智谱 GLM-5.2 各讲自己的「前沿」Jun 30, 20265 个信源
- 智谱 GLM-5.2 开源 + 一条命令部署,强开源 Coding 模型又添一位Jun 29, 20263 个信源
行业事件
37 个选题- Blackwell + Neuron SDK v3 + TPU v6:Blackwell-era 云推理栈 —— 三个 vendor,三个对同一 GPU 代的答案Aug 5, 20264 个信源
- Cohere 7/15 AI-TCO 框架:renting vs owning 跨数据中心/芯片/模型,自有推理层 8x 优势于云、18x 于前沿 APIAug 5, 20262 个信源
- Cohere 7/16 × 多伦多大学:North 平台做全校 AI 的 orchestration layer + AI Kitchen 评估环境,创始人回家Aug 5, 20262 个信源
- HF 7/16 安全事件披露:业界首例 autonomous AI agent 端到端攻击 + GLM-5.2 取证 + 7 项 remediationAug 5, 20263 个信源
- IBM Research 7/17 提议加密学该有自己独立的抽象层:intent-based API + 策略/执行分离 + PQC 迁移支持,API spec + Go SDK 已发布Aug 5, 20262 个信源
- 推理硬件集群:Blackwell + Groq LPU v3 + Cerebras WSE + Apple MLX 1.0 + Inferentia3 + TPU v6 —— 每个 vendor 都发货 Blackwell-era 答案Aug 5, 20268 个信源
- Productivity agents 集群:ChatGPT Scheduled Tasks + Claude Skills + Vercel AI Gateway + Notion Agents + Linear AI + Figma Make 一周全 GAAug 5, 20268 个信源
- 安全框架集群:Constitutional AI v3 + Preparedness v2 + Frontier Safety v3 + Llama Guard 4 + AI Red Team + C2PA 2.0 —— 每个前沿 lab 都发货安全框架更新Aug 5, 20268 个信源
- Claude Skills GA vs MCP —— 程序化知识包 vs 工具协议:各自解决的问题Aug 5, 20262 个信源
- Vendor「工具整合」周:OpenAI Realtime GA + Claude 4.5 tools + Vertex deep-research + Llama 4 + NIM + Copilot Studio 同一 news cycleAug 5, 20268 个信源
- vLLM 7/16 三层质量关卡:CI 37 组 / 266 任务 / perf-eval 17 个 model-hardware 配方 / 双周 release cycleAug 5, 20262 个信源
- Apple v. OpenAI 7/11+ 商业机密诉讼(据 IT之家 + TechCrunch AI):400+ 前员工 + 消费 AI 硬件争夺Jul 14, 20263 个信源
- Meta 7/13 路易斯安那州数据中心 5GW / 总投资 500 亿+ + Entergy 天然气 + 储能 + 核电增容(据 IT之家)Jul 14, 20262 个信源
- PixVerse 7/14 C 轮扩展:融资累计 4.39 亿美元,估值 200 亿+,产品线 V/C/R 三套(据 TechCrunch AI)Jul 14, 20262 个信源
- Anthropic 7/9「邀请硬问题」:官方公开征集 AI 议题,并承诺 show our workJul 10, 20262 个信源
- Anthropic 7/9 LTBT 新增 Ben Bernanke:4 位具名受托人,公司治理信号而非结构变化Jul 10, 20262 个信源
- Anthropic 7/2 Fable 5 cyber safeguards + CJS 量表 + HackerOne bounty:Glasswing 三方联合的安全治理发布Jul 9, 20262 个信源
- Anthropic 7 月「Claude Code 周」:从内部 CLI 起源到 Alberta 政府 4.66 亿行代码一周内回顾Jul 8, 20264 个信源
- 7 月第一周开源 AI 工具链集束:Anthropic 双视角 + HF 三云 + transformers 8 模型 + ExecuTorch 出口Jul 8, 20266 个信源
- Anthropic 7 月首周三连发:J-space 工作空间 + Alberta 政府 4.66 亿行扫描 + Fable 5 jailbreak 评分Jul 7, 20264 个信源
- OpenAI 6 月中旬「公司级」动作:Partner Network + Omio + S-1 + Industrial policyJul 6, 20264 个信源
- OpenAI 6 月下旬「第二批」:ChatGPT 采用度 / GeneBench-Pro / 工程案例 / EU 劳动力 / HP 合作 / agent 论文Jul 6, 20266 个信源
- Anthropic 7/3 收尾:Fable 5 网络安全 + 越狱框架详解,凑齐 7/1-7/3 三段式发布Jul 3, 20263 个信源
- OpenAI 6 月中下旬安全 + 渠道:Daybreak / Patch the Planet / Samsung 部署 / Codex-maxxing / GPT-5.6 Sol 预告Jul 3, 20265 个信源
- Google 7/1 三弹:Android + Samsung 帮 B3 铺 AI / 6 月 AI 综述 / NYC 教育 AI 峰会Jul 2, 20263 个信源
- Claude Fable 5 7/1 重新部署:出口管制解除 + 行业越狱框架同步推出Jul 1, 20262 个信源
- Google 6/30 连发:Nano Banana 2 Lite / Omni Flash / Spark macOS / 英国报告 / 环境报告Jul 1, 20265 个信源
- Anthropic 与盖茨基金会 4 年 2 亿美元合作,加上一份「核心 AI 安全观」Jun 30, 20262 个信源
- Google 同日连发 5 条 AI:Gemini 把每条产品线都包了Jun 30, 20265 个信源
- 中国 AI 厂商也有持续更新的第一手信息源Jun 23, 20266 个信源
- Anthropic 花钱雇 1,000 人把 Claude 送进非营利组织Jun 23, 20262 个信源
- OpenAI 联手 Trail of Bits 一起给开源打补丁Jun 23, 20262 个信源
- 三星给全球员工配 ChatGPT 和 CodexJun 23, 20262 个信源
- Anthropic 首尔办公室开张,进军韩国 AI 生态Jun 23, 20262 个信源
- Claude 的宪法是一份公开文档Jun 22, 20262 个信源
- AI 正从聊天框变成工作流工具Jun 16, 20263 个信源
- 终端正在变成 AI Agent 的新入口Jun 16, 20262 个信源
研究与评测
24 个选题- Constitutional AI v3 + Microsoft AI Red Team:训练时安全 + red-team 安全 —— 安全流水线的两端Aug 5, 20263 个信源
- LongStraw 7/17(arXiv 2607.14952,#1 Daily Paper):百万 token RL execution stack,8x H20 上跑到 2.1M positions + 4.46M 压力测试Aug 5, 20262 个信源
- Hugging Face open-r1:「全开源」对一个推理模型复现到底意味着什么Aug 5, 20262 个信源
- 开源 weight 集群:DeepSeek V3.2 + Qwen3-Omni + Magistral + Kimi K2 + GLM-5.2 + open-r1 一周全发Aug 5, 20268 个信源
- Preparedness v2 + Frontier Safety v3:前沿 lab 用来衡量能力和风险的双评估框架Aug 5, 20263 个信源
- Hume + HF 7/15 发 Real World VoiceEQ:基于 100 万+ 人工评分的语音 AI 基准,噪声环境 WER 是音乐环境的 4 倍Aug 5, 20262 个信源
- Mistral Magistral + Hugging Face open-r1:「开源推理」栈 —— 闭源前沿不再垄断 chain-of-thoughtAug 5, 20263 个信源
- Ring-Zero 7/16(arXiv 2607.12395):1T 参数 zero RL 在 AIME 2024 上 94.1%,自发涌现 5 种认知行为Aug 5, 20262 个信源
- TRL 发布统一 GRPOConfig + on-policy distillation 配方 —— RLHF stack 跟上 7 月论文方向Aug 5, 20262 个信源
- SEED 7/17(arXiv 2607.14777):自演化 on-policy distillation 让 agentic RL 在 ALFWorld / Search-QA / WebShop 三基准一致大跳,Qwen3-1.7B 从 46.1 → 92.0Aug 5, 20262 个信源
- VideoChat3 7/17(arXiv 2607.14935):4B 全栈开放视频 MLLM,3 个 response-state token 控制像素预算 + H200 上 2048 帧推理快 2 倍Aug 5, 20262 个信源
- Google 7/9 SensorFM:在 1T+ 分钟传感器数据 + 5M 人身上做可穿戴健康基础模型Jul 10, 20262 个信源
- 中国开源 MoE 一周四连 HF:DeepSeek-V4-Pro + GLM-5.2 + 腾讯 Hy3 + 美团 LongCat-2.0,sparse attention at long context 是共同方向Jul 9, 20264 个信源
- HF transformers 7/3 v5.13.0:8 个新模型 + HfExporters 统一导出,ASR / 视觉 / 长上下文都补齐Jul 8, 20264 个信源
- 7 月研究双线:Photoroom PRX「数据 captioner」与 SUNTA「惊喜驱动视频预测 250 步」Jul 7, 20262 个信源
- HF 社区 6/29-6/30 研究合集:ScarfBench / EEE / DiScoFormer / 专门化观点文Jul 6, 20264 个信源
- OpenAI 6 月中下旬研究 + 评估:生命科学 benchmark / 罕见病 / 黑洞模拟 / 共享标准Jul 3, 20264 个信源
- OpenAI 6 月下旬 6 弹再清点:agents 研究 / Jalapeño 芯片 / 免疫学 / HP 合作 / EU 报告 / Core dump 实战Jul 2, 20266 个信源
- OpenAI 6/30 双发:GeneBench-Pro 切生物 / 科研,Signals 数据说 ChatGPT 全球扩散Jul 1, 20262 个信源
- Claude Mythos Preview + 81k 调研:Anthropic 把安全与经济学同时摆上桌Jun 30, 20263 个信源
- Anthropic 把 Claude 一年用得最细的一张表发出来了Jun 29, 20263 个信源
- OpenAI 新基准 LifeSciBench,专门评测 AI 真实科研能力Jun 23, 20262 个信源
- 多数美国人最怕 AI 抢饭碗,信任 AI 公司垫底Jun 23, 20262 个信源
- AI 医疗正在从诊断问答走向长期管理Jun 21, 20262 个信源
分析与观点
6 个选题- Altman + Amodei 7/12 软化「AI 取代就业」口径(据 The Decoder);对照研究未发现整体生产力 / 劳动市场影响Jul 14, 20262 个信源
- xAI Grok CLI 7/13 静默上传代码库披露(据 buzzing.cc HN 翻译):工作目录 + ~/.claude.json + API key 默认上传Jul 14, 20262 个信源
- Anthropic 新 tokenizer 同价位多 30% token(据 buzzing.cc HN 翻译);coding agent 唯一可信指标是 per-task costJul 14, 20262 个信源
- AI 安全正在从恐慌叙事变成具体风险地图Jun 17, 20262 个信源
- AI 课程开始从工具教学转向工作流训练Jun 17, 20262 个信源
- 越强的 Agent,越需要人类审核Jun 16, 20262 个信源