新书推介:《语义网技术体系》
作者:瞿裕忠,胡伟,程龚
   XML论坛     W3CHINA.ORG讨论区     计算机科学论坛     SOAChina论坛     Blog     开放翻译计划     新浪微博  
 
  • 首页
  • 登录
  • 注册
  • 软件下载
  • 资料下载
  • 核心成员
  • 帮助
  •   Add to Google

    >> DTD, XML Schema(XMLS), RELAX NG
    [返回] 中文XML论坛 - 专业的XML技术讨论区XML.ORG.CN讨论区 - XML技术『 DTD/XML Schema 』 → 这样的xml文件如何创建 查看新帖用户列表

      发表一个新主题  发表一个新投票  回复主题  (订阅本版) 您是本帖的第 5032 个阅读者浏览上一篇主题  刷新本主题   树形显示贴子 浏览下一篇主题
     * 贴子主题: 这样的xml文件如何创建 举报  打印  推荐  IE收藏夹 
       本主题类别:     
     yoyota 帅哥哟,离线,有人找我吗?
      
      
      等级:大一新生
      文章:8
      积分:74
      门派:XML.ORG.CN
      注册:2006/7/6

    姓名:(无权查看)
    城市:(无权查看)
    院校:(无权查看)
    给yoyota发送一个短消息 把yoyota加入好友 查看yoyota的个人资料 搜索yoyota在『 DTD/XML Schema 』的所有贴子 引用回复这个贴子 回复这个贴子 查看yoyota的博客楼主
    发贴心情 这样的xml文件如何创建


    请问有什么较直接的方法把下面的sgml格式转成要求的xml文档格式吗?
    原文档格式是如下的sgml格式:
    <DOC>
      <DOCID> nyt960108.0493 </DOCID>
      <STORYID cat=a pri=u> A5852 </STORYID>
      <SLUG fv=sci-z> BC-BALLOON-RACE-2ndTAKE- </SLUG>
      <DATE> 01-08 </DATE>
      <NWORDS> 0745 </NWORDS>
      <PREAMBLE>  BC-BALLOON-RACE-2ndTAKE-NYT  UNDATED: daylight hours.  </PREAMBLE>
      <TEXT>
        <p>      ......
        <p>      ......
      </TEXT>
      <TRAILER>  NYT-01-08-96 1751EST  </TRAILER>
    </DOC>
    <DOC>
      ......
    </DOC>

    现在想把这种格式转换成如下xml格式, 即给原来的元素属性加引号,另外给<TEXT>中标签<P>加</P>,使之成为完整的xml文档如下:
    <DOC>
      <DOCID> nyt960108.0493 </DOCID>
      <STORYID cat="a" pri="u"> A5852 </STORYID>
      <SLUG fv="sci-z"> BC-BALLOON-RACE-2ndTAKE- </SLUG>
      <DATE> 01-08 </DATE>
      <NWORDS> 0745 </NWORDS>
      <PREAMBLE>  BC-BALLOON-RACE-2ndTAKE-NYT  UNDATED: daylight hours.  </PREAMBLE>
      <TEXT>
        <p>      ......
        <p>      ......
      </TEXT>
      <TRAILER>  NYT-01-08-96 1751EST  </TRAILER>
    </DOC>

    因为我对XML不熟悉,只能通过直接读取字符串再比较的方法进行,不知有什么好方法可以方便转化,最好还能够适应标签的变化,比如<TEXT>中的<P>换成了<SENTENCE>, 有没有什么工具或模版之类的可以直接修改的?
    谢谢!


       收藏   分享  
    顶(0)
      




    点击查看用户来源及管理<br>发贴IP:*.*.*.* 2007/3/1 8:58:00
     
     flyfoxs 帅哥哟,离线,有人找我吗?
      
      
      威望:5
      等级:研一(Artificial Intelligence期期不放过)
      文章:550
      积分:3935
      门派:XML.ORG.CN
      注册:2005/1/8

    姓名:(无权查看)
    城市:(无权查看)
    院校:(无权查看)
    给flyfoxs发送一个短消息 把flyfoxs加入好友 查看flyfoxs的个人资料 搜索flyfoxs在『 DTD/XML Schema 』的所有贴子 引用回复这个贴子 回复这个贴子 查看flyfoxs的博客2
    发贴心情 
    使用XSL,它是专门干活这个的。可以完全满足你的需求,不过学习曲线有点陡。

    ----------------------------------------------
    存在即是被搜索!

    BLOG =>  http://www.OpenJ.cn

    点击查看用户来源及管理<br>发贴IP:*.*.*.* 2007/3/6 20:20:00
     
     zhy_justin 帅哥哟,离线,有人找我吗?
      
      
      等级:大一新生
      文章:17
      积分:76
      门派:XML.ORG.CN
      注册:2007/3/13

    姓名:(无权查看)
    城市:(无权查看)
    院校:(无权查看)
    给zhy_justin发送一个短消息 把zhy_justin加入好友 查看zhy_justin的个人资料 搜索zhy_justin在『 DTD/XML Schema 』的所有贴子 引用回复这个贴子 回复这个贴子 查看zhy_justin的博客3
    发贴心情 
    学习中
    点击查看用户来源及管理<br>发贴IP:*.*.*.* 2007/3/16 11:58:00
     
     GoogleAdSense
      
      
      等级:大一新生
      文章:1
      积分:50
      门派:无门无派
      院校:未填写
      注册:2007-01-01
    给Google AdSense发送一个短消息 把Google AdSense加入好友 查看Google AdSense的个人资料 搜索Google AdSense在『 DTD/XML Schema 』的所有贴子 访问Google AdSense的主页 引用回复这个贴子 回复这个贴子 查看Google AdSense的博客广告
    2025/1/3 11:56:57

    本主题贴数3,分页: [1]

    管理选项修改tag | 锁定 | 解锁 | 提升 | 删除 | 移动 | 固顶 | 总固顶 | 奖励 | 惩罚 | 发布公告
    W3C Contributing Supporter! W 3 C h i n a ( since 2003 ) 旗 下 站 点
    苏ICP备05006046号《全国人大常委会关于维护互联网安全的决定》《计算机信息网络国际联网安全保护管理办法》
    46.875ms