今天abc看了啥🤔

  1. 论文称近半数第三方中转API存在模型不一致问题3月5日发布于arXiv的论文对17个被187篇论文使用的第三方中转API进行审计

    Forwarded from 科技圈🎗在花频道📮
    论文称近半数第三方中转API存在模型不一致问题

    3月5日发布于arXiv的论文对17个被187篇论文使用的第三方中转API进行审计。这类API并非官方提供,而是由第三方转接官方大模型接口。研究通过性能测试和模型指纹识别核查其是否实际调用所标称模型 。

    结果显示,在24个测试端点中,45.83%未通过模型身份验证。部分接口在医学和法律等测试中表现明显低于官方版本。例如在MedQA测试中,Gemini-2.5-flash官方准确率为83.82%,通过相关中转API调用后平均降至约36.95%。论文认为,这可能影响科研结果的可靠性

    arXiv

    🍀在花频道 🍵茶馆聊天 📮投稿

  2. 💧 #小众软件QQ 机器人终于转正:腾讯官方开放 OpenClaw 接入,1 分钟扫码即用(详细教程)

    💧 #小众软件
    QQ 机器人终于转正:腾讯官方开放 OpenClaw 接入,1 分钟扫码即用(详细教程)
    https://www.appinn.com/openclaw-channel-qqbot/ OpenClaw 接入 QQ 机器人:腾讯官方入口,1 分钟扫码即用(详细教程) - 小众软件

  3. GPT‑5.4 in Codex includes experimental support for the 1M context window. Developers can try this by configuring model_context_window and model_auto_compact_token_limit. Requests that exceed the standard 272K context window count against usage limits at 2x the normal rate.

    今天abc看了啥🤔
    https://openai.com/index/introducing-gpt-5-4/
    GPT‑5.4 in Codex includes experimental support for the 1M context window. Developers can try this by configuring model_context_window and model_auto_compact_token_limit. Requests that exceed the standard 272K context window count against usage limits at 2x the normal rate.

  4. 一个完全在 GPU 上运行的 CPU原文:

    Forwarded from Hacker News 摘要
    一个完全在 GPU 上运行的 CPU
    原文:https://github.com/robertcprice/nCPU
    阅读时间:7 分钟
    分数:243

  5. 关于一个浮点数如何逆推 Claude Code 的 Token 计费系统的事

    关于一个浮点数如何逆推 Claude Code 的 Token 计费系统的事
    https://she-llac.com/claude-limits suspiciously precise floats, or, how I got Claude's real limits

  6. 又一次 ollama 事件复刻吗,不过这可比 ollama 杀伤力高多了.jpg打开满屏都是 百度智能云/腾讯云/阿里云 和一堆 🇨🇳 旗子,心满意足的关掉(

    又一次 ollama 事件复刻吗,不过这可比 ollama 杀伤力高多了.jpg

    打开满屏都是 百度智能云/腾讯云/阿里云 和一堆 🇨🇳 旗子,心满意足的关掉(

    https://openclaw.allegro.earth/

  7. 很有趣的角度,像这样的角度还有很多,在怀疑国家公布的数据或者根本就没有数据的情况下,这些角度可以为我们提供很直观的结果

    Forwarded from 布告栏上的贴纸
    很有趣的角度,像这样的角度还有很多,在怀疑国家公布的数据或者根本就没有数据的情况下,这些角度可以为我们提供很直观的结果

    https://telegra.ph/媒体是否在夸大东北人口流出的事实-03-02

  8. 今天,阿里巴巴AI的总称和核心品牌统一为千问,千问大模型(Qwen)涵盖基础大模型与专业领域模型,千问APP是我们在C端的旗舰AI应用

    Forwarded from 无印🐑品 #BeHonest
    今天,阿里巴巴AI的总称和核心品牌统一为千问,千问大模型(Qwen)涵盖基础大模型与专业领域模型,千问APP是我们在C端的旗舰AI应用。统一名称之后,阿里巴巴大模型品牌中文为“千问大模型”,英文为“Qwen”,“通义实验室”为阿里巴巴集团旗下AI机构的组织名称。

    https://weibo.com/7983316472/QucA2jFUf