← 往期列表

日报


读过 150 篇 · 精选 30 篇

略读 预计 5 分钟

SOTA Models Should Learn to Kiss (Claude Fable 5 Experiment)

本文通过一个 Next.js 缓存失效实验,探讨了顶级 AI 模型在编程时倾向于过度设计(Overengineering)而非遵循 KISS 原则的现象。

Fable 5 模型用 tags + revalidateTag 修复了缓存失效 bug,方案更通用但比 revalidatePath 多了点架构

Hacker News · 1 赞 · 0 评 进入阅读 →
精读 预计 5 分钟

HN: Claudectl – A workspace manager for Claude Code

专为 Windows 设计的 Claude Code 终端工作区管理器,通过 TUI 强化多项目会话管理与上下文维护。

Windows Claude Code 多项目工作区管理器,终端 UI 管会话搜索恢复、自动维护 CLAUDE.md 和 MCP 文档

Hacker News · 1 赞 · 0 评 进入阅读 →
略读 预计 3 分钟

How bigger data diminish the value of research to business

探讨会计学术研究为何因过度依赖大数据而导致对现实商业的解释力大幅下降。

大样本数据让会计研究发现效果小到只有 1990 年代一半,但这正是给创业的深度洞见:手动收集数据聚焦大 M 效应

Hacker News · 1 赞 · 0 评 进入阅读 →
精读 预计 23 分钟

What Would It Look Like If the AI Bubble Popped?

深度分析 AI 投资泡沫破裂的潜在后果,指出其演变路径更接近 2000 年互联网泡沫而非 2008 年金融危机。

AI 泡沫破裂更像 dot-com 崩盘而非 2008,数据中心支出崩或拖累经济但杠杆低冲击有限

Hacker News · 1 赞 · 0 评 进入阅读 →
略读 预计 8 分钟

Precision Matters in Block Scales

探讨在 NVFP4 等两级缩放数值格式中,为何块缩放(Block Scale)的精度比范围更重要。

NVFP4 张量级 FP32 标尺帮块尺度专注相对幅度,优化 AI 推理量化

Hacker News · 1 赞 · 0 评 进入阅读 →
略读 预计 11 分钟

UX Collective: The Prompt is not an Interface

深度探讨为何 AI 提示词界面是交互设计的 “大倒退”,以及为何未来的 AI 交互必须从 “文字描述” 回归 “视觉操作”。

提示不是界面,AI 强制设计师从绘制转向打字,视觉信息丢失惨重

Hacker News · 1 赞 · 0 评 进入阅读 →
略读 预计 1 分钟

OpenAI Prepping for On-Prem Product?

OpenAI 更新服务条款,新增 “许可材料” 相关规定,暗示其正在筹备本地化部署(On-Prem)产品。

OpenAI 为本地部署产品铺路,合同要求终止后永久删除所有副本,退出成本得提前算

Hacker News · 1 赞 · 0 评 进入阅读 →
精读 预计 8 分钟

Data Science Weekly – Issue 655

汇总了 AI 机器人学原理、生物制药中的 “反规模效应”、DeepMind 科学家求职经验及 R 语言新工具等前沿技术与职业发展资讯。

物理 AI 把机器人模型扔进动态世界多了推理时间这根轴,生物反 scaling 观点直接戳穿药物开发乐观泡沫

Hacker News · 1 赞 · 0 评 进入阅读 →
精读 预计 6 分钟

Building an AI-Friendly Company, Just in Case AI Takes over the World

PAX ERP 公开文档提供 .md 原始版 + llms.txt 索引 + 完整 bundle,让 AI 系统直接读取无需视觉界面,附带 Paxy AI 案例,适合想让 AI 辅助 ERP 文档的团队参考。

PAX ERP 给 AI 准备了 llms.txt 索引和 .md 完整包,帮代理直接读懂文档一步到位

Hacker News · 1 赞 · 0 评 进入阅读 →
预计 17 分钟

We Had to Ban 65 CTF Teams to Get a Top 10 Leaderboard

揭秘 BYUCTF 2026 如何通过禁赛 65 支作弊战队才凑齐前十名,并探讨了 OSINT 挑战在 AI 时代作为 “反作弊” 防线的独特价值。

BYUCTF 为了公平直接 ban 65 队,才把 top 10 留给干净选手

Hacker News · 1 赞 · 0 评 进入阅读 →
预计 4 分钟

Agents' Last Exam

由伯克利 RDI 联合 300 多位专家推出的 AI Agent 大规模评测基准,聚焦 55 个细分行业的真实工作流。

Agents' Last Exam 只是个 AI 代理基准推广,啥干货都没给

Hacker News · 1 赞 · 0 评 进入阅读 →
略读 预计 14 分钟

GEDD – Grounded Eval-Driven Development for AI Agents

介绍 GEDD,一个面向 AI PM 和领域专家的 AI Agent 评估工作台,旨在通过 “扎根理论” 将专家的人工评估转化为可落地的自动化评测标准。

GEDD 用场景驱动让 AI 产品经理直接标注专家语言错误

Hacker News · 1 赞 · 0 评 进入阅读 →
精读 预计 3 分钟

Parse, Don't Guess

探讨 API 设计中 “宁可返回空,也不要靠猜测” 的原则,通过作者删除 PostgreSQL 解析器中启发式代码的案例,说明确定性对系统可靠性的重要性。

无 schema 就直接空,而不是猜 SQL 外键关系

Hacker News · 1 赞 · 0 评 进入阅读 →
精读 预计 7 分钟

RawTree

介绍专为 AI Agent 设计的分析型数据库 RawTree,主打 “先入库后建模”,支持根据查询模式自动优化物理结构。

RawTree 直接 ingest JSON 就开表查 SQL,自动建索引,完美适配 AI 代理数据没 schema 的场景

Hacker News · 1 赞 · 0 评 进入阅读 →
略读 预计 13 分钟

Memes > Doom: How TikTokers and YouTubers See AI

一项针对 2.5 万条视频的分析显示,大众对 AI 的关注点与精英阶层严重脱节:社交媒体用户更在意 AI 模因和创意侵权,而非宏大的末日论或文明变革。

TikTokYouTubers 把 AI 当日常生产力乐趣,3:1 采用压倒质疑,远超精英叙事

Hacker News · 1 赞 · 0 评 进入阅读 →
略读 预计 8 分钟

GitLab building AI scale Git time faster

GitLab 发布一系列 “智能体基础设施” 更新,包括提速 50 倍的新一代 SCM 引擎和旨在减少 AI 幻觉的上下文图谱 GitLab Orbit。

Orbit 上下文图让 AI 代理从碎片化变成全生命周期决策,Compare the Market 实测评论位置准确率 70%

Hacker News · 2 赞 · 0 评 进入阅读 →
精读 预计 9 分钟

Snapcompact, SoTA Compaction: Instant, Local, Free. Pick 3

介绍一种将长文本渲染为高密度像素 PNG 图片的上下文压缩技术,在降低约 2 / 3 Token 成本的同时保持近乎 100% 的信息召回率。

Snapcompact 把上下文塞进图片直接传给模型,F1 依然 0.86–0.96 还省三分之二 token

Hacker News · 2 赞 · 0 评 进入阅读 →
精读 预计 2 分钟

OpenCode Data

OpenCode Data 页面展示最近 3 个月国内 AI 模型在 OpenCode Go 平台上的实时使用数据,包括 Top 模型排行、周变化、成本与缓存比例,适合关注模型生态与市场动态的读者参考。

中文 AI 模型使用数据:1T 模型占主导,Zhipu MiniMax Qwen 合计占 69%+

Hacker News · 2 赞 · 0 评 进入阅读 →
略读 预计 3 分钟

Have you bought a car lately?

面对 AI 带来的职业焦虑,作者通过回顾过去 20 年技术变革的起伏,指出 “个人效率提升将取代团队” 的预言往往并不会完全成真。

AI 替整个团队抢饭饭,过去 20 年全被证伪,Ruby on Rails 至今还活得很好

Hacker News · 2 赞 · 0 评 进入阅读 →

读完去做事。