LLM

0关注 | 19内容

关注
热门排序
  • Pydantic 校验通过不等于答案正确:如何识别 LLM 的语义错误

    本地测试时,结构化输出最容易给人一种“问题已经解决”的错觉:模型返回 JSON,解析器没有报错,Pydantic 模型实例化成功,数据库也顺利写入。真正上线一段时间后,团队才发现其中有些记录虽然格式完

    分享
    评论
    投蕉
  • AI 结构化输出的隐形失败:合法 JSON 不等于正确数据

    很多人接入 OpenAI 结构化输出(Structured Outputs)的体验是这样的:用 Pydantic 定义一个模型,把 response_format 指过去,模型就乖乖按字段返回,不再有

    分享
    评论
    投蕉
  • 用 OpenAI Agents SDK 构建一个能写代码、还能执行代码的 AI Agent

    大语言模型(LLM)已经能够生成代码,但真正让 Agent 发挥价值的,并不是"写代码",而是写完之后还能自己运行、验证,再根据结果继续迭代。拥有代码执行能力后,一个 Agent 就不仅仅是聊天机器人

    分享
    评论
    投蕉
  • 来玩!主包耗时一个月制作的酒馆同人角色卡 附带安装宝宝教程

    1373次播放 | 11:10
    分享
    11
    74
  • 初次用AI AGENT开发的动画Tier List制作工具-总结报告

    最近试了试agent,惊为天人,想着用它整点啥,刚好,我觉得TierMaker的UI太丑了,我的审美疯狂拒绝我使用,所以决定自行制作,耗时一周搓了出来,请欣赏我的shi山!另外真的是0基础,一行代码也

    共8张
    分享
    6
    40
  • 用AI搓了个「动画评价排行」工具附带AI雌小鬼动画总结-BGM-AniTier

    1059次播放 | 04:02
    分享
    4
    35
  • 为创作同人动画 开发了个星铁剧情索引AI [俊达萌]

    1043次播放 | 06:01
    分享
    1
    35
  • DeepSeek-V4预览版本正式上线并同步开源

    DeepSeek-V4 拥有百万字超长上下文,在 Agent 能力、世界知识和推理性能上均实现国内与开源领域的领先。模型按大小分为两个版本:最新的 DeepSeek-V4 , 1M 超长上下文记忆的全

    分享
    12
    投蕉
  • 重生之我在带专学AI第2集:新建LLM环境

    这把主要是要部署三个大模型的环境,blueLM——VIVO大模型、qwen——阿里千问、chatglm3——清华智谱。1.blueLM根据2月份的博主分析,蓝心大模型,在中文处理上堪称世界第一,我直接

    共11张
    分享
    7
    5
  • 怎么使用python访问大语言模型

    395次播放 | 08:30
    分享
    评论
    15
  • 关于我目前的状况,以及“再平衡”

    342次播放 | 04:58
    分享
    评论
    10
  • Asteria吐槽自动机: 基于大模型的弹幕生成工具

    169次播放 | 05:41
    分享
    评论
    5
  • C++手搓大模型推理引擎

    94次播放 | 08:01
    分享
    评论
    投蕉
  • International Trade Law 国际贸易法

    1165次播放 | 00:40
    分享
    评论
    投蕉
  • Nature新闻:未来的智能会是什么样的?答案可能蕴含在它进化历程的故事中。

    人工智能的出现或许只是一个指导性生物过程中的最新阶段,这个过程在生命历史的长河中创造了越来越复杂、相互依存的有机体。十年前,我还会对机器能够思考的想法嗤之以鼻。在2010年代,我在谷歌研究团队工作,致

    分享
    评论
    投蕉
  • 正在加载

    APP内打开

    取消
    继续
    立即领取