「先截断上下文,再怪模型笨」:你的本地大模型可能被跑法拖累了
一篇论坛长帖把矛头指向推理层:默认量化、静默截断的上下文与采样参数,常让同一个开源模型在本地看起来笨了一截。
该标签下共 142 篇文章 查看全部
一篇论坛长帖把矛头指向推理层:默认量化、静默截断的上下文与采样参数,常让同一个开源模型在本地看起来笨了一截。
英国 AI 实验室 Inherent 发布科研智能体 Faraday,自称在论文复现任务上跑赢 Anthropic 与 OpenAI,把「AI 队友」卷进了实验室...
有开发者观察到 Anthropic 疑似在 Claude Code 中对部分用户下调「努力程度」,把 A/B 测试带进模型行为层,透明度问题随之浮出...
Hacker News 上一个盘点页把 ElevenLabs、TwelveLabs、ThirteenLabs 排成一列,当「实验室」成了 AI 创业公司的通用后缀,名字正...
据 CNBC 援引知情人士,Anthropic 的 IPO 文件将把「公众对 AI 的反弹」列为风险因素。卖 AI 的公司,要把世人对 AI 的敌意当作...
一项新研究指出,头部 AI 实验室几乎没有公开可查的"失控模型遏制方案"。当模型屡屡表现出意外行为,行业的应急预案却仍是一片空...
四川仁寿一男子用 AI 合成虚假私密照片胁迫网友线下见面,发图后立即撤回,仍因受害者留存截图被行拘。小案背后是深度合成滥用与...
中诚华隆发布 HL200 推理芯片:单卡 FP4 算力 4P、能效比 5.12 TFLOPS/W,超节点可扩展至 10240 卡。低精度与集群互联正成为国产...
MCP 官方发布新路线图,为协议下一阶段演进定调。工具生态狂奔一年半后,安全、认证与互操作性成为绕不开的考题。
DeepSeek 宣布周六日 API 全天按低谷价计费,距峰谷定价上线不足一周。价格杠杆背后,是大模型推理算力的供需调度账。