新招数揭示AI模型“内心戏”
研究人员发明了一种方法,能从Claude、GPT和Gemini等主流AI模型中提取“推理轨迹”。通过分析这些轨迹,他们发现了一些有趣的现象:部分中国AI模型的训练过程中,可能使用了美国领先模型的输出作为数据。这一发现引发了关于AI技术跨境影
研究人员发明了一种方法,能从Claude、GPT和Gemini等主流AI模型中提取“推理轨迹”。通过分析这些轨迹,他们发现了一些有趣的现象:部分中国AI模型的训练过程中,可能使用了美国领先模型的输出作为数据。这一发现引发了关于AI技术跨境影
Ars Technica报道的最新研究揭示,大型语言模型在微调过程中即使被明确告知某些陈述为假,仍会倾向于相信并自信地将其呈现为真。这种“偏见”表明当前AI系统存在深层漏洞,对事实核查和AI安全构成重大挑战。本文综合原文分析与行业背景,深入
OpenAI 的聊天机器人 ChatGPT 在英文对话中频繁使用 'goblin' 一词,引发网络热潮;但在中文版本里,它却执着于 '稳稳地' 这个副词,让中国用户哭笑不得。这一奇特的语言癖好背后,折射出 AI 模型在不同语言文化下的训练偏