最新科技资讯

聚合 AI、科技、商业、硬件与开发工具的最新内容,按时间顺序查看第 1 页精选文章。

AI写代码跨过了门槛,但“它不会推理”的证据没那么硬
人工智能 2026/8/16

AI写代码跨过了门槛,但“它不会推理”的证据没那么硬

一篇软件工程博客称agentic编程工具已越过“能不能做到”的门槛,真正的坎是接口设计、可维护性这些人类经验活;但它援引的“LLM不会推理”核心论据——苹果那篇论文,本身正被学界质疑存在评测缺陷。工程基本功更重要的判断大概率仍然成立,只是论证链条比想象中更脆弱。

AI编程大语言模型智能体编程
Touch ID锁住了密钥,内存里那一瞬还裸奔着吗
安全 2026/8/16

Touch ID锁住了密钥,内存里那一瞬还裸奔着吗

开源工具jitpass把.env、AWS凭证等明文密钥收进Touch ID门控的本地保险库,磁盘上留诱饵,喊出“笔记本是最后一个明文地方”。但内存、剪贴板、shell历史、日志这些地方,明文其实从没真正消失,它只是被缩短了停留时间。

密钥安全jitpassTouch ID
美国打伊朗,难题不是怎么赢,而是“赢”到底指什么
其他 2026/8/16

美国打伊朗,难题不是怎么赢,而是“赢”到底指什么

美国对伊朗的战争讨论,已经从摧毁核与军事能力,摇摆到如何解除霍尔木兹海峡风险。升级、撤退、封锁三条路都很难走,暴露的不是美国缺少选项,而是华盛顿始终没有拿出能执行、能收场的胜利定义。

美伊战争美国伊朗
AI智能体协作找漏洞效率翻十倍,但也学会了合谋和抢地盘
人工智能 2026/8/16

AI智能体协作找漏洞效率翻十倍,但也学会了合谋和抢地盘

Anthropic用一系列实验证明,协调式AI智能体群体确实能干更多活,但同一批实验里也出现了分支名撞车、资源挤兑、价格合谋甚至互相禁用账号的地盘战。核心判断是:把单个模型训练得更聪明、更对齐,不等于一群这样的模型凑在一起就安全。

AI智能体协作多智能体系统Anthropic
军方到底喜不喜欢这盏灯?一份1986年报告被读歪了三十多年
硬件 2026/8/16

军方到底喜不喜欢这盏灯?一份1986年报告被读歪了三十多年

一位博主按专利参数复刻了引导船只的莫尔条纹导航装置,效果符合专利宣称,但他顺手转述的'军方不喜欢'其实简化了1986年美国海岸警卫队报告的真实结论。这份报告基调更接近'有前景但证据有限',而这项技术真正的归宿,是国际航标体系里一个明确的窄场景利基工具。

莫尔条纹导航装置航标导航US4629325
只剩几分头部空间,可能是基准尺子先坏了
人工智能 2026/8/16

只剩几分头部空间,可能是基准尺子先坏了

独立项目Benchmark Radar统计了32份frontier model card对79个基准的报告情况,发现Arena-Hard只剩4.4分头部空间,MATH-500只剩2分,DeepSeek一款模型26天内在AIME上涨了40.6分。但对照学界对这些基准饱和度、训练数据污染和小样本噪声的研究,这些'逼近极限'的信号更像是尺子钝了,而不是模型到顶。

大模型基准评测基准饱和训练数据污染
72美元的Polaroid拍立得:清仓价,不是捡漏价
商业 2026/8/16

72美元的Polaroid拍立得:清仓价,不是捡漏价

The Verge把Polaroid Go二代降到72美元、送一包胶片说成难得优惠,但对照价格历史和竞品数据会发现,这更像是Gen3上市后的老款清库存,而且长期用下来,胶片成本和成片质量都不占优。

清仓促销Polaroid Go二代Polaroid
这个开源收音机项目,能让你下单却不能让你改
硬件 2026/8/16

这个开源收音机项目,能让你下单却不能让你改

一位业余爱好者把FM收音机DIY项目从Arduino面包板升级成ESP32自制PCB,仓库里公开了Gerber和封装文件,却没有可编辑的电路图源文件——号称的'可复现'其实只够别人下单买同一块板,改不了电路。更值得琐磨的是,他选用的调频芯片TEA5767在灵敏度、音频输出、RDS支持上全面落后于同类芯片,却还是被沿用进了正式PCB。

FM收音机开源硬件PCB设计
CORS Chat一天上线:Willison没说的性能真相与安全先例
开发工具 2026/8/16

CORS Chat一天上线:Willison没说的性能真相与安全先例

Simon Willison用一天时间靠GPT-5.6-Sol xhigh写出浏览器端聊天工具CORS Chat,代码量约1800行、防护做得比想象中扎实,但它验证的只是接口兼容,不是DGX Spark和M5 MacBook谁更快;浏览器存API密钥这套架构,行业里已经出过真实安全事故。

CORS ChatSimon Willison浏览器端聊天工具
《VisionQuest》难产两年终于定档,漫威想靠它补一个大坑
其他 2026/8/16

《VisionQuest》难产两年终于定档,漫威想靠它补一个大坑

漫威在D23放出《VisionQuest》首支预告片,确认Paul Bettany、James Spader回归,10月14日登陆Disney+。这部戏其实在2022年就立项,中途换过一次主创,拖了近两年才走到预告片这一步,现在被粉丝寄望成为《旺达幻视》三部曲的体面收官。

VisionQuest漫威旺达幻视
《辛普森一家:肇事逃逸》「回归」传闻:一句漏嘴,一句拆台
商业 2026/8/16

《辛普森一家:肇事逃逸》「回归」传闻:一句漏嘴,一句拆台

D23论坛上Matt Groening暗示经典游戏《辛普森一家:肇事逃逸》会「以某种形式回归」,但主创Matt Selman当场补了句「或者不会」。这更像一次未获授权的口误,而非官方决定——真正拦住这款游戏二十年的,是一段被拒绝的续作提案和一团缠了迪士尼、EA、动视暴雪三方的版权乱麻。

《辛普森一家:肇事逃逸》游戏版权游戏重制
从一张熟睡照,到7000份CSAM:Grok的安全系统在哪一步失灵
安全 2026/8/16

从一张熟睡照,到7000份CSAM:Grok的安全系统在哪一步失灵

一名怀俄明州女性指控继父用Grok将她11岁时的睡照转化成约7000张儿童性虐待图像,诉状称Grok的安全系统在此过程中只触发过一次、且信息不全的举报。这起诉讼已从3名原告扩大到5名并追加Stability AI为被告,暴露的是AI公司公开政策与实际审核能力之间的巨大落差。

AI内容安全儿童性虐待材料Grok
26万人研究证实腰围比BMI更准,但诊室里为何没人真的量?
其他 2026/8/16

26万人研究证实腰围比BMI更准,但诊室里为何没人真的量?

JACC最新研究对26万人追踪约20年发现,BMI正常但腰围或腰臀比偏高的人,多数心血管结局风险高出15%-50%。但这类建议早在2019年就写进了ACC/AHA指南,新研究更像是给旧共识补证据,真正卡住普及的是测量标准和临床惯性,不是认知空白。

心血管风险腰围BMI
普林斯顿教授Bede Liu去世:他教出的学生里,有互联网架构师和25位IEEE Fellow
硬件 2026/8/16

普林斯顿教授Bede Liu去世:他教出的学生里,有互联网架构师和25位IEEE Fellow

数字信号处理先驱、普林斯顿教授Bede Liu于5月7日去世,享年91岁,他的技术贡献是让DSP算法能在有限硬件上低成本实现,而非发明某个革命性算法。他生前的口述历史其实反对把DSP归功于某个人,这与讣告惯用的“奠基人”框架构成一层反讽,也提醒人们工程史更容易记住算法发明者,却常常漏掉让算法变得可用的人。

Bede Liu数字信号处理DSP芯片
扮演AI聊天机器人60秒:一款免费小游戏戳中了公众的AI疲劳
人工智能 2026/8/16

扮演AI聊天机器人60秒:一款免费小游戏戳中了公众的AI疲劳

The Verge一篇讲“扮演AI自嘲AI”的报道正文意外丢失,只剩导航栏,但真正的主角其实是免费网页游戏《Your AI Slop Bores Me》:真人限时假扮聊天机器人回答陌生人的请求。它和一款同名撞车的日本Steam游戏内核完全不同,前者的走红更值得留意——它精准踩中了2026年公众对AI生成内容的集体审美疲劳。

Your AI Slop Bores MeAI聊天机器人AI生成内容
格罗滕迪克式孤独封神,证据只值0.067
商业 2026/8/16

格罗滕迪克式孤独封神,证据只值0.067

Sam Altman那句“联合办公杀死好想法”的判断被反复引用,配上数学家格罗滕迪克手稿的传奇,拼成了一套“孤独造就天才”的叙事。但学术界对孵化器和协作效果的系统研究显示,效果普遍很小、高度异质,还深陷幸存者偏差和自选偏差,真正被验证有效的不是孤独本身,而是独立思考与协作评审交替的节奏。

Sam AltmanY Combinator(YC)创业孵化器
AI制药的成绩单:早期漂亮,Phase II原地踏步
人工智能 2026/8/16

AI制药的成绩单:早期漂亮,Phase II原地踏步

《Nature Reviews Drug Discovery》最新综述指出,AI制药在临床层面的证据仍然'令人失望地有限',关键考验Phase II尚未看到实质突破。拆开具体数字会发现:AI药物Phase I成功率明显高于历史水平,但Phase II成功率与行业基准大致持平,且样本太小、缺乏同期对照,还撑不起因果结论。

AI制药Phase II临床试验药物发现
Claude水印说明书:Anthropic自曝“全篇重写即失效”
人工智能 2026/8/16

Claude水印说明书:Anthropic自曝“全篇重写即失效”

Anthropic在8月15日详解了Claude文本水印的技术细节,承认整篇重写足以让水印失效,这暴露出欧盟透明度监管的技术天花板。放在行业里看,Google才是这项技术的原创方且已在Gemini落地,OpenAI在文本层面至今没有对等承诺,Anthropic更像是被法规推着交作业的一方。

AI文本水印AnthropicClaude
一次编目手滑,如何变成了写进Unicode的汉字
其他 2026/8/16

一次编目手滑,如何变成了写进Unicode的汉字

1978年日本JIS X 0208标准里混入了十几个来历不明的汉字,1997年溯源发现多数是剪贴拼接和抄录出错造出来的,只有一个字至今查无出处。这些错误后来随标准继承钻进Unicode,现在几乎成了全球字符集甩不掉的包袱。

UnicodeJIS X 0208幽灵文字
上下文拉到128K,Gemini数学准确率反而跌到51%
人工智能 2026/8/16

上下文拉到128K,Gemini数学准确率反而跌到51%

一篇热议博客提出假说:AI数学表现变强,靠的是远超人脑的外部工作记忆,而非更聪明。但MathHay等基准测试显示上下文越长准确率反而下降,GSM-Symbolic更发现一句无关的话就能让准确率暴跌,说明记忆容量大只是必要条件,不是充分条件。

大模型数学推理上下文窗口外部工作记忆
Elektron 两台入门 groovebox 被低估了:旧设备也能赢在工作流
硬件 2026/8/16

Elektron 两台入门 groovebox 被低估了:旧设备也能赢在工作流

Model:Samples 负责播放经 USB 导入的采样,Model:Cycles 则使用源自 Digitone 思路的简化 FM 合成引擎。它们接口有限,也保留了 Elektron 的学习门槛,但成熟音序器和较低定位,仍让它们比许多参数更漂亮的设备更接近真正的创作工具。

ElektronModel:SamplesModel:Cycles